/ ai资讯

科大讯飞首发超拟人数字人实时生成技术,打破虚拟形象体验边界

发布时间:2026-08-03 11:46:06

近日,科大讯飞正式对外发布全新超拟人数字人实时生成技术,这项技术能在极短时间内生成神态、动作、表情都和真人几乎看不出差别的虚拟数字人,而且全程实现实时渲染输出,不用再花几小时甚至几天时间做后期渲染,直接把数字人的逼真度和实时交互体验拉到了全新的水平。

很多人之前接触过的数字人,大多是提前录好视频素材,或者只能做出比较生硬的表情动作:说话的时候嘴型对不上,面部肌肉动起来很僵硬,转头、抬手的动作也透着明显的“虚拟感”,一眼就能看出是AI生成的假人。而科大讯飞这次的新技术,直接把数字人的拟人度提升了好几个档次,生成的虚拟形象不管是微表情的变化、说话时嘴唇的细微动作,还是眨眼、点头这些下意识的小细节,都和真实人类的状态几乎一模一样,不仔细分辨根本看不出这是一个AI生成的数字人。

最关键的是,这套技术实现了完全的实时生成,不需要提前花大量时间做渲染预处理。过去要做一段几分钟的高清逼真数字人视频,往往要靠高性能服务器算好几个小时才能出片,根本做不到和人实时对话互动。现在用这套新技术,你对着数字人说一句话,它能立刻实时生成对应的口型、表情和动作,马上给你回话,整个过程几乎感觉不到延迟,就像真的在和一个坐在屏幕对面的真人面对面聊天一样。

这项技术落地之后,最先改变的就是很多需要高频线上交互的场景。比如银行、运营商的线上客服,以后不用再是冷冰冰的文字聊天,也不用对着提前录好的生硬数字人视频,你点开视频客服窗口,就能看到一个神态自然的数字人客服实时和你对话,你问什么问题它都能立刻对着你解答,还会根据你说的内容自然做出点头、微笑这些对应的反应,体验感比过去的线上客服好出一大截。

在直播、短视频创作领域,这项技术也能带来很多新的可能性。普通创作者不用再自己长时间坐在镜头前拍视频,也不用花大价钱找专业团队做后期渲染,只要输入一段文字文案,几秒钟就能生成一段超逼真的数字人讲解视频,而且全程都是实时生成,随时修改文案就能立刻重新生成内容,大大降低了短视频的制作门槛。甚至以后很多24小时不间断的直播,都可以用超拟人数字人来做,不用真人主播熬夜轮班,就能全程保持自然流畅的直播状态。

还有远程办公、线上教育这类场景,体验也会迎来大幅升级。以后开线上会议,你不用再对着一个个静止的头像,系统可以实时把你的形象渲染成超逼真的数字人,哪怕你不开摄像头,对方看到的也是一个神态自然、跟着你说话同步做动作的虚拟形象,线上会议的氛围感直接拉满。线上上课的时候,数字人老师能像真人老师一样自然地做表情、打手势,讲课的代入感比过去对着PPT念的录播课强很多,学生听课的注意力也更容易集中。

科大讯飞还给这套技术做了轻量化适配,不用特别昂贵的高性能专业服务器,普通的主流配置电脑甚至部分高性能终端设备,就能流畅运行这套实时生成系统,不用用户额外投入巨额的硬件成本,就能享受到超拟人数字人的体验。

这次超拟人数字人实时生成技术的首发,直接把虚拟数字人的实用门槛打了下来。过去只能在科幻电影里看到的和虚拟人自然面对面交流的场景,现在已经能实实在在落地到我们日常的工作、生活里,后续会有越来越多的场景用上这项技术,给大家带来更自然、更有温度的数字交互体验。

免责声明:本文为转载,非本网原创内容,不代表本网观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。

如有疑问请发送邮件至:bangqikeconnect@gmail.com