科大讯飞(iFLYTEK)近日推出数字人创作平台,可仅凭一张照片生成逼真的数字人。此前,制作类似的数字人通常需要约两小时的视频录制。这一变化大幅降低了数字人制作的门槛。

从一张照片开始

据介绍,这套系统整合了讯飞星火语音大模型以实现自然对话,并借助垂直行业知识库来降低幻觉率,同时支持可定制的人设与长期记忆。生成的数字人能够做出自然的表情、手势与口型同步,还能完成拿取物品、饮水、唱歌、跳舞等较复杂的动作,并实时互动。

在商业落地方面,科大讯飞相关业务负责人表示,数字人的应用场景涵盖品牌直播、客户服务与无人零售等。市场也在快速扩张:2025年,中国数字人核心市场规模达到480.6亿元(约合71.2亿美元),预计到2030年将增至935.6亿元。

火热的市场,遇冷的落地

竞争同样激烈。腾讯旗下游戏直播业务发布了支持全天候直播的实时多模态数字人模型,百度则推出数字人视频播客方案,据称可将制作成本降低74%。不过,业内也存在“市场火热、落地遇冷”的落差,不少数字人仍停留在照本宣科的展示层面,难以支撑长时间的实时互动。

工业和信息化部信息通信经济专家委员会委员盘和林认为,随着大模型的应用,数字人正从少数企业的高端工具,逐步变成更普遍的商业标配。技术门槛下降之后,真正的竞争,或许在于谁能让数字人“用得起来、用得长久”。