虚拟人赛道正从娱乐动捕向AI实时交互转型。慧夜科技创始人渠思源与投资人冯铮指出,AI虚拟人的真正价值在于下一代空间交互与服务属性,生成式技术正大幅重构3D内容生产门槛与交互效率。

从早期虚拟偶像到各类品牌代言人,虚拟人正加速进入大众视野。但形态相似的虚拟人背后存在两条截然不同的技术路径:一类依赖真人动作捕捉与实时渲染(即“中之人”驱动),另一类则完全依托 AI 进行生成与交互。
专注于 AI 驱动虚拟人技术的服务商慧夜科技,已完成数百万美元 Pre-A 轮融资。在创始人兼 CEO 渠思源与投资方顺为资本副总裁冯铮看来,虚拟人产业正处于由冷转热的关键转折点,其演进逻辑与产业价值正被重新定义。
顺为资本副总裁冯铮指出,过去的虚拟人主要满足娱乐需求,如初音未来或游戏 NPC,背后依托的是 CG 特效;而新一代 AI 驱动虚拟人的本质是“服务”,核心在于提供实时交互,最终依靠解决具体业务问题实现商业化变现。
例如在餐饮点单、车载助手以及企业接待等场景中,AI 虚拟人展现出了标准化与规模化的服务能力。随着未来硬件设备逐步普及,虚拟人将成为三维数字空间中最基础的交互载体。
关于 AI 生成与真人动捕的竞争关系,渠思源认为两者并非替代,而是互补:对精度和剧情定制要求极高、类似演戏的场景,真人动捕更具优势;而在需要 24 小时不间断、大规模分发服务的场景下,AI 驱动则是唯一解法。

渠思源将虚拟人的发展划分为三个阶段:
从 2.0 迈向 3.0 预计需要 3 至 5 年时间,当前主要面临两项挑战:一是底层技术的攻坚,涵盖动作与微表情的细腻度、高并发实时渲染速度及多模态交互;二是产品形态的探索,即在传统网页与移动 App 之后,定义企业利用虚拟人提供服务的最优交互形态。

在传统动画制作流程中,1 名动画师耗时 1 天通常仅能完成 7 至 10 秒的动作内容;即便是真人动捕,也需要演员排练、场地采集及漫长的后期修帧。慧夜科技通过自研的深度学习算法,可根据输入的音频或音乐,实时驱动虚拟角色的口型、面部表情与全身舞蹈动作,实现所见即所得的内容产出,使生产效率实现质的飞跃。
目前,慧夜科技业务主要面向企业端(ToB):一方面服务服装、汽车、珠宝等消费品牌,提供端到端的数字人形象定制及驱动服务;另一方面服务互联网平台与游戏公司,将原本扁平的 2D 交互升级为 3D 智能体交互,同时正在推进 Web 端数字人工具产品“雪浪纸”的研发落地。
谈及风格偏好,渠思源表示,团队虽然支持写实与二次元等多种美术风格,但并不认为行业终局唯有超写实一条路。虚拟世界的核心在于承载人类的想象力,技术服务商的核心竞争力在于算法跨风格的兼容能力,以及深入产业定义产品的工程化落地效率。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断