Meta AI发布炸裂项目audio2photoreal 可将音频生成全身逼真的虚拟人物形象
Meta AI最近发布了一项引人注目的技术,他们成功地开发出一种能够从音频中生成逼真的虚拟人物形象的系统。
这个系统能够根据多人对话中的语音生成与对话相对应的逼真面部表情、完整身体和手势动作。这些虚拟人物不仅在视觉上非常逼真,而且能够准确地反映出对话中的手势和表情细节,例如指点、手腕抖动、耸肩、微笑和嘲笑等。

项目及演示:https://people.eecs.berkeley.edu/~evonne_ng/projects/audio2photoreal/
代码:https://top.aibase.com/tool/audio2photoreal
Demo:https://colab.research.google.com/drive/1lnX3d-3T3LaO3nlN6R8s6pPvVNAk5mdK
这个系统的工作原理如下:
首先,Meta AI团队捕获了一组丰富的双人对话数据集,这些数据集能够提供逼真的重建。然后,他们构建了一个复合运动模型,其中包括面部运动模型、引导姿势预测器和身体运动模型。
在生成面部运动时,系统使用预训练的唇部回归器处理音频,提取与面部运动相关的特征,并利用条件扩散模型生成面部运动。
在生成身体运动时,系统根据音频自回归地输出每秒1帧的向量量化(VQ)引导姿势。然后,将音频和引导姿势输入到扩散模型中,以每秒30帧的速度生成高频身体运动。
最后,生成的面部和身体运动被传入训练好的虚拟人物渲染器,生成逼真的虚拟人物。
最终展示的结果是根据音频生成的全身逼真虚拟人物,这些虚拟人物能够表现出对话中的细微表情和手势动作。
这项技术的发布将为虚拟人物的创造和应用领域带来巨大的进步。无论是在游戏开发、虚拟现实还是电影制作领域,这种能够从音频中生成逼真虚拟人物的系统都将发挥重要作用。
Meta AI的成果再次展示了他们在人工智能领域的卓越能力和创新精神。他们不断推动着技术的边界,为我们带来了一个全新的虚拟人物生成的时代。我们可以期待在不久的将来,这种技术将成为我们生活中不可或缺的一部分。
X 公司起诉多家大广告商联合 “非法抵制”
近日,X公司对多家知名广告商提起了诉讼,指控他们对平台进行了一场“非法抵制”。在这份周二提交的诉状中,X声称包括联合利华、玛氏、CVS、Ørsted等在内的数十个品牌,共同策划了一项“集体扣留数十亿美元广告收入”的行动。这些品牌是通过一个名为全球负责任媒体联盟(GARM)的行业倡议进行合作,要求参与的公司必须停止向不符合该组织安全标准的社交平台投放广告。站长网2024-08-07 10:21:010000区块链百科全书IQ.wiki推出基于ChatGPT的搜索引擎“IQ GPT”
IQ.wiki是一个基于区块链的百科全书,现已推出基于OpenAI的ChatGPT技术的搜索引擎,以帮助加密货币用户搜索各种来源的信息。站长网2023-08-11 16:15:290000茶饮门店用KOC玩法一年赚1000多万!
他曾拥有30家直营茶饮店,年营收达到1500万,私域用户积累达25万。然而在疫情过后,由于同行低价竞争的加剧,他们过去的私域策略通通失效,新客户难以吸引,私域优惠券销售停滞,原本依赖私域流量的商业模式受到了重创。面对成本压力和用户行为的变化,拔尖文化CEO陈文不得不进行策略调整。他意识到,要想在价格战中生存,必须拥有供应链优势,而这对于小规模企业来说几乎不可能。站长网2024-05-22 19:53:460001通义灵码技术解析,打造 AI 原生开发新范式
大家好,我是通义灵码的产品技术负责人陈鑫。过去有八年时间,我都是在阿里集团做研发效能,即研发工具相关的工作。我们从2015年开始做一站式DevOps平台,然后打造了云效,也就是将DevOps平台实现云化。到了2023年,我们明显感觉到大模型时代来了以后,软件工具将面临着彻底的革新,大模型和软件工具链的结合,使软件研发进入下一个时代。站长网2024-05-13 16:44:000000全球首家AI餐厅开业 机器人全自动做汉堡和炸薯条
划重点:🔍世界首家全自动、由人工智能驱动的餐厅最近在南加州开业。🔍CaliExpressbyFlippy餐厅使用机器人烹饪汉堡和炸薯条。🔍这家餐厅的菜单包括汉堡、芝士汉堡和薯条,顾客可以在机器人烹饪过程中进行定制。全球首家全自动、由人工智能驱动的餐厅CaliExpressbyFlippy于去年12月在南加州开业。在这家餐厅,机器人负责烹饪汉堡和炸薯条。站长网2024-01-03 14:42:570000