带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究(4)

简介: 带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究

带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究(3)

https://developer.aliyun.com/article/1262083?groupCode=taobaotech



动作捕捉

制作动画的成本相对都比较高,原因是上述两种动画技术通常是关键帧动画。假设一个人抬起手肘,那么手臂和手 腕也会因此而产生连贯性的动作。如果要实现这样一段动画,关键帧将会非常之多,制作起来也会异常困难。为了 有效降低制作成本,我们需要用到动作捕捉的技术,通常我们把动作捕捉技术分为2大方向4个类别,可以用四象限 图来描述:


image.png


我们用手机摄像头完成的AR互动游戏、AR面具等功能实际就是光学识别+无穿戴设备这一象限内的技术。  


编排 - 导演系统

我们再来对比下几种方式制作的成本和灵活度。


image.png


手K动画的制作成本无疑是最高的,灵活度和效果也是最好的,同时也要求经验丰富的绑定师和动画师才能完成。 动作捕捉的制作需要一套专业的动捕设备,一个能容纳这些设备和能满足做所需动作的场地,一个动作制作周期少 则几个小时,多则几天。在面临诸如众多舞蹈场景的运营需求下,最适合的方案是把多个已经制作完成的动作,自 由或智能编排成一个剧本,就像拍戏时剧本是导演提前设计好的,演员只需依照剧本表演出来就行,故也称为“导 演系统”。


image.png


动作的串联需要解决一个问题:动作1到动作2如何过渡衔接。这便需要用到混合动画(Blending Animation)技 术。混合动画的基础原理是以动作1当前状态为起点、动作2的指定状态为终点,计算关键帧的插值**。简单的可以 使用线性插值,复杂的也可以使用贝塞尔曲线插值等。关于混合动画的知识点和方案非常多,也适用于不同的场景 和需求,大家可以自行搜索,例如Unity和Unreal也都提供了很多不同的混合方案。


image.png


有了导演系统后,就可以提供自由的组合能力,比如想举行一场虚拟演唱会,也可以通过导演系统完成表演。


image.png



这个章节我们来探索虚拟数字人的神 - “拥有比拟人的思想,具有识别外界环境、并能与人交流互动的能力”。我 们在对“神”的研究上,仍然处于非常初级的阶段,一方面它需要大数据的支撑,另一方面它对于前端这个岗位来 说已经有相当的距离了。为了让虚拟数字人更加真实,“神”会是未来重点的研究方向。  


性格流露 - 自然语音合成

虚拟数字人的语言表达能力需要用到语音合成技术,比如TTS(Text To Speech)。阿里达摩院有着非常完善的 TTS引擎,用它就能让虚拟数字人开口说话。不过这也仅仅是开口说话,大家其实都能感受到这样的语言非常苍白 无力,毫无“情感”,无法在不同性格和情感时表达出来的不同语气。在业界可以看到一些优秀的成果: YAMAHA的歌声合成系统“VOCALOID”(初音未来和洛天依均在使用),谷歌基于深度学习的端到端语音合成 系统“Tacotron”,以及讯飞的语音合成系统等。阿里达摩院也在持续研究更加符合自然表达的语音合成系统,通 过为虚拟数字人设定性格,并借助大数据的深度学习来产生风格迥异的情感型语气。大家可以细细评委下以下三段 真人、普通TTS和风格化TTS的效果。至此,在现有的技术下我们完成了一个超级虚拟偶像的登场。

image.png


带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究(5)

https://developer.aliyun.com/article/1262080?groupCode=taobaotech


相关文章
|
7月前
|
传感器 人工智能 搜索推荐
|
18天前
|
API 语音技术 开发者
基于开源技术的数字人实时对话:形象可自定义,支持语音输入,对话首包延迟可低至3s
魔搭社区最近上线了基于开源技术的数字人实时对话demo,无需预训练即可使用自定义的数字人形象进行实时对话,支持语音输入和实时对话。
|
4月前
|
机器学习/深度学习 人工智能 自然语言处理
【人工智能】python之人工智能应用篇--数字人生成技术
数字人生成技术是基于人工智能技术和计算机图形学技术创建的虚拟人物形象的技术。该技术能够模拟人类的外貌、声音、动作和交流能力,为多个领域带来创新的应用可能性。数字人的本质是将所有信息(数字和文字)通过数字处理(如计算机视觉、语音识别等)再进行表达的过程,形成具有人类形态和行为的数字产物。 数字人的生成涉及到多种技术,如3D重建技术,使用三维扫描仪扫描人的外观、五官等,并通过3D模型重建三维人;虚拟直播技术,使用计算机技术生成人物或实体,并且可以实时直播、录制;数字人体数据集技术,利用数据构建数字人模型以及训练虚拟现实引擎等
127 4
|
5月前
|
新零售 人工智能 vr&ar
国家发展改革委等部门:鼓励利用数字人等技术拓展电商直播场景!
国家发改委推出措施鼓励创新消费场景,特别提到利用AI、VR等技术增强购物体验,支持数字人电商。青否数字人直播系统提供独立部署方案,适应抖音直播并解决封号问题,具备实时话术改写和AI智能回复功能,确保互动合规。此系统适用于24小时直播,降低商家成本,提升效率。欲了解更多信息,可访问:zhibo175。
国家发展改革委等部门:鼓励利用数字人等技术拓展电商直播场景!
|
6月前
|
算法
VASA-1:实时音频驱动的数字人说话面部视频生成技术
【6月更文挑战第8天】VASA-1是实时音频驱动的数字人面部视频生成技术,能根据输入音频精准生成匹配的面部表情。具备实时性、高准确性和适应性,适用于虚拟主播、在线教育和影视娱乐等领域。简单示例代码展示了其工作原理。尽管面临情感理解和硬件优化等挑战,但随着技术发展,VASA-1有望在更多领域广泛应用,开启生动数字世界的新篇章。
286 5
|
6月前
|
机器学习/深度学习 人工智能 自然语言处理
【数字人】AIGC技术引领数字人革命:从制作到应用到全景解析
【数字人】AIGC技术引领数字人革命:从制作到应用到全景解析
646 0
|
传感器 人工智能 达摩院
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究(1)
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究
188 0
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究(1)
|
对象存储 流计算 CDN
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究(2)
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究
187 0
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究(3)
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究
173 0
|
数据采集 前端开发 大数据
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究(5)
带你读《2022技术人的百宝黑皮书》——虚拟数字人行业现状和技术研究
237 0

热门文章

最新文章