Meta AI发布炸裂项目audio2photoreal 可将音频生成全身逼真的虚拟人物形象
Meta AI最近发布了一项引人注目的技术,他们成功地开发出一种能够从音频中生成逼真的虚拟人物形象的系统。
这个系统能够根据多人对话中的语音生成与对话相对应的逼真面部表情、完整身体和手势动作。这些虚拟人物不仅在视觉上非常逼真,而且能够准确地反映出对话中的手势和表情细节,例如指点、手腕抖动、耸肩、微笑和嘲笑等。
项目及演示:https://people.eecs.berkeley.edu/~evonne_ng/projects/audio2photoreal/
代码:https://top.aibase.com/tool/audio2photoreal
Demo:https://colab.research.google.com/drive/1lnX3d-3T3LaO3nlN6R8s6pPvVNAk5mdK
这个系统的工作原理如下:
首先,Meta AI团队捕获了一组丰富的双人对话数据集,这些数据集能够提供逼真的重建。然后,他们构建了一个复合运动模型,其中包括面部运动模型、引导姿势预测器和身体运动模型。
在生成面部运动时,系统使用预训练的唇部回归器处理音频,提取与面部运动相关的特征,并利用条件扩散模型生成面部运动。
在生成身体运动时,系统根据音频自回归地输出每秒1帧的向量量化(VQ)引导姿势。然后,将音频和引导姿势输入到扩散模型中,以每秒30帧的速度生成高频身体运动。
最后,生成的面部和身体运动被传入训练好的虚拟人物渲染器,生成逼真的虚拟人物。
最终展示的结果是根据音频生成的全身逼真虚拟人物,这些虚拟人物能够表现出对话中的细微表情和手势动作。
这项技术的发布将为虚拟人物的创造和应用领域带来巨大的进步。无论是在游戏开发、虚拟现实还是电影制作领域,这种能够从音频中生成逼真虚拟人物的系统都将发挥重要作用。
Meta AI的成果再次展示了他们在人工智能领域的卓越能力和创新精神。他们不断推动着技术的边界,为我们带来了一个全新的虚拟人物生成的时代。我们可以期待在不久的将来,这种技术将成为我们生活中不可或缺的一部分。
微信公众平台要求短剧小程序缴纳保证金
据上证报报道,今日有用户陆续收到微信公众平台发布的保证金缴纳通知。通知称,根据《小程序交易保证金管理规定》,你的小程序“XX剧场”需要缴纳保证金。微信公众平台提醒,需在2023年12月17日前完成缴纳,否则相关功能可能收到限制,包括但不限于限制小程序搜索等。0000Stable Diffusion采样器怎么选?不同采样器原理对比及选择建议
有用过StableDiffusion的用户都知道,StableDiffusion有很多采样器,但是有不少人并不知道,什么场景适合使用哪个采样器。现在,我发现了一篇科普StableDiffusion采样器工作指南的文章《CompleteguidetosamplersinStableDiffusion》。如果你也对StableDiffusion采样器不了解的话,可以看看:站长网2024-01-23 10:20:320002众筹网站Kickstarter要求生成式AI项目披露更多信息 否则项目会被暂停
众筹平台Kickstarter近日宣布,对于使用生成式人工智能(AI)工具创作图像、文本或其他作品的项目,将要求其在项目页面上披露更多与AI相关的信息。站长网2023-08-02 11:43:020000DALL-E将推图片编辑功能 生成图像可局部重绘
DALL-E即将推出图片的编辑功能,类似于局部重绘。这意味着用户可以通过画笔涂抹指定区域,然后对该区域进行重绘。这一功能的推出将为用户提供更多的创作可能性,让他们能够更加灵活地编辑和调整图像。产品入口:https://top.aibase.com/tool/dalle-3站长网2024-03-26 17:15:430000蔡崇信:中国有80%科技企业和一半大模型公司都跑在阿里云上
2023云栖大会现场,阿里巴巴集团主席蔡崇信发言指出,智能化时代正在开启,AI将成为各行业新型生产力,目前中国80%的科技企业和一半的大模型公司都跑在阿里云上面。图源备注:图片由AI生成,图片授权服务商Midjourney站长网2023-10-31 12:14:060000