Meta AI发布炸裂项目audio2photoreal 可将音频生成全身逼真的虚拟人物形象
Meta AI最近发布了一项引人注目的技术,他们成功地开发出一种能够从音频中生成逼真的虚拟人物形象的系统。
这个系统能够根据多人对话中的语音生成与对话相对应的逼真面部表情、完整身体和手势动作。这些虚拟人物不仅在视觉上非常逼真,而且能够准确地反映出对话中的手势和表情细节,例如指点、手腕抖动、耸肩、微笑和嘲笑等。
项目及演示:https://people.eecs.berkeley.edu/~evonne_ng/projects/audio2photoreal/
代码:https://top.aibase.com/tool/audio2photoreal
Demo:https://colab.research.google.com/drive/1lnX3d-3T3LaO3nlN6R8s6pPvVNAk5mdK
这个系统的工作原理如下:
首先,Meta AI团队捕获了一组丰富的双人对话数据集,这些数据集能够提供逼真的重建。然后,他们构建了一个复合运动模型,其中包括面部运动模型、引导姿势预测器和身体运动模型。
在生成面部运动时,系统使用预训练的唇部回归器处理音频,提取与面部运动相关的特征,并利用条件扩散模型生成面部运动。
在生成身体运动时,系统根据音频自回归地输出每秒1帧的向量量化(VQ)引导姿势。然后,将音频和引导姿势输入到扩散模型中,以每秒30帧的速度生成高频身体运动。
最后,生成的面部和身体运动被传入训练好的虚拟人物渲染器,生成逼真的虚拟人物。
最终展示的结果是根据音频生成的全身逼真虚拟人物,这些虚拟人物能够表现出对话中的细微表情和手势动作。
这项技术的发布将为虚拟人物的创造和应用领域带来巨大的进步。无论是在游戏开发、虚拟现实还是电影制作领域,这种能够从音频中生成逼真虚拟人物的系统都将发挥重要作用。
Meta AI的成果再次展示了他们在人工智能领域的卓越能力和创新精神。他们不断推动着技术的边界,为我们带来了一个全新的虚拟人物生成的时代。我们可以期待在不久的将来,这种技术将成为我们生活中不可或缺的一部分。
AI“孙燕姿”火了!专家称孙燕姿音色不受法律保护
5月12日消息,一夜之间AI孙燕姿”火遍全网。在B站上,AI孙燕姿翻唱的林俊杰《她说》、周董《爱在西元前》、赵雷《成都》等等,让一众网友深陷无法自拔。网友表示,听了一晚上AI孙燕姿,出不去了......这些翻唱作品基于一个叫做so-vits-svc的开源项目。仅凭数段音频,就可用一个生成式模型来合成目标音色的音频,训练出用户想要的声学模型。这个模型可以保留音高和音调,也可以用不同的语言来翻唱。0000大厂围堵AI创业曝「死亡名单」,前谷歌大佬出走几乎无一幸免!
前谷歌员工出走创立的AI初创公司,一个个都被大科技公司收购了!硅谷吹的这是什么邪风?外媒总结了一波谷歌AI研究人员创业难的原因,更是「扎心」地给出了一个预言名单,一一点名了眼瞅着就要被大公司收购的企业。万众瞩目的AI初创明星公司,才四个月就风光不再了?刚刚传出消息,法国AI初创公司H(原名Holistic),才刚获得了2.2亿美元的种子轮融资,就被曝出联创出走了!站长网2024-08-28 14:17:330000“网”罗河南!《2022河南省互联网发展报告》这些数据与你我息息相关
站长网2023-05-24 22:33:280000小米汽车APP登顶苹果App Store免费榜
小米汽车旗下的SU7车型于3月28日正式发布并上市,而在其发布前夕,小米汽车App已经于3月25日提前上架苹果AppStore,并迅速登陆各大安卓应用商店。令人瞩目的是,小米汽车App在极短时间内便成功登顶苹果AppStore免费榜,充分显示了市场对小米汽车的期待与关注。站长网2024-04-06 14:16:150000微软Windows10 和 Windows11 的照片应用增加AI橡皮擦功能
划重点:1.🚀微软宣布推出GenerativeErase功能,为Windows10和11的照片应用增加了类似MagicEraser的人工智能橡皮擦功能。2.📷这一功能使用户能够轻松进行图像中的AI移除操作,提高了照片编辑的便捷性和效果。3.💡GenerativeErase标志着微软在图像处理领域的不断创新,为用户提供了更丰富的编辑工具和体验。站长网2024-02-23 10:31:030000