会员登录 - 用户注册 - 设为首页 - 加入收藏 - 网站地图 EMAGE:上传音频就能生成全身动作 包括头部、嘴型、身体运动!

EMAGE:上传音频就能生成全身动作 包括头部、嘴型、身体运动

时间:2024-07-02 03:32:54 来源:带水拖泥网 作者:短视频 阅读:764次

EMAGE:上传音频就能生成全身动作  包括头部、嘴型、身体运动

划重点:

⭐️ 提出了 EMAGE 框架,上生成身体用于从音频和掩码手势生成全身人类手势。传音

⭐️ 引入了新的全身全面共话数据集 BEATX,结合 MoShed SMPLX 身体与 FLAME 头部参数,动作提高了建模质量。包括

⭐️ EMAGE 利用掩码手势先验信息进行训练,头部采用 Masked Audio Gesture Transformer 实现音频到手势生成,嘴型取得了最先进的运动性能。

CSS站长资源(ChinaZ.com)4月3日 消息:最近,上生成身体多所知名大学和研究机构的传音研究人员共同提出了 EMAGE 框架,旨在从音频和掩码手势生成全身人类手势。全身

EMAGE技术能实现输入音频生成全身动作,动作包括头部、包括嘴型、头部身体、嘴型手部和整体运动,跟之前Meta的audio2photoreal很像。用户只要上传音频(小于60秒),然后点击提交,输出结果将在输出中呈现3分钟。

他们引入了新的全面共话数据集 BEATX,该数据集结合了 MoShed SMPLX 身体和 FLAME 头部参数,进一步提高了建模质量,特别是对头部、颈部和手指动作的建模。EMAGE 在训练过程中利用了掩码手势的先验信息,以提高推断性能。该框架包括一个 Masked Audio Gesture Transformer,有助于联合训练音频到手势生成和掩码手势重建,有效地编码音频和身体手势提示。从掩码手势中编码的身体提示随后分别用于生成面部和身体动作。

此外,EMAGE 自适应地合并了音频的节奏和内容的语音特征,并利用了四个组合 VQ-VAE 来增强结果的保真度和多样性。实验证明,EMAGE 具有最先进的性能,能够生成具有完整的、音频同步的整体手势。

EMAGE 技术的问世将在各个领域产生深远影响,其中包括但不限于教育、医疗、娱乐等领域。研究团队表示,他们的代码和数据集已经公开提供,供学术和工业界使用。

项目入口:https://top.aibase.com/tool/emage

在线体验:https://huggingface.co/spaces/H-Liu1997/EMAGE

(责任编辑:小程序)

相关内容
  • 比开车快2小时!安徽男子开小飞机带女儿回家过年
  • 中国智能音箱创3年来跌幅 小米拿下
  • 库克透露AI动向:苹果市值大涨超11000亿元!
  • 董明珠称应强制报废旧家电!格力宣布:拿出30亿为以旧换新补贴
  • 智心云言体验入口 AI智能对话与绘画工具在线使用地址
  • 明明不开车 为啥还被称为副驾驶 快转发给老婆
  • 董明珠称应强制报废旧家电!格力宣布:拿出30亿为以旧换新补贴
  • 五一假期景区有多堵:排队4小时才能看到乐山大佛佛脚
推荐内容
  • 奇瑞回应徐奶奶车被奔驰男砸:我们的车主奶奶我们自己宠 已送新车瑞虎9代步
  • 今年Q1全球手机排名:三星 小米增长最快!苹果手机均价无人敌
  • 汉服成为新晋顶流:西安三步一个公主五步一个贵妃
  • 小米SU7哨兵模式存满后只能手动删除 官方回应:马上OTA
  • “Linux 中国” 开源社区宣布停止运营
  • 比亚迪保险来了 含交强险、商业险等15个汽车险种