您现在的位置是：短视频 >>正文

EMAGE：上传音频就能生成全身动作包括头部、嘴型、身体运动

短视频4635人已围观

简介划重点:⭐️ 提出了 EMAGE 框架，用于从音频和掩码手势生成全身人类手势。⭐️ 引入了新的全面共话数据集 BEATX，结合 MoShed SMPLX 身体与 FLAME 头部参数，提高了建模质量。 ...

划重点:

⭐️ 提出了 EMAGE 框架，上生成身体用于从音频和掩码手势生成全身人类手势。传音

⭐️ 引入了新的全身全面共话数据集 BEATX，结合 MoShed SMPLX 身体与 FLAME 头部参数，动作提高了建模质量。包括

⭐️ EMAGE 利用掩码手势先验信息进行训练，头部采用 Masked Audio Gesture Transformer 实现音频到手势生成，嘴型取得了最先进的运动性能。

CSS站长资源（ChinaZ.com）4月3日消息:最近，上生成身体多所知名大学和研究机构的传音研究人员共同提出了 EMAGE 框架，旨在从音频和掩码手势生成全身人类手势。全身

EMAGE技术能实现输入音频生成全身动作，动作包括头部、包括嘴型、头部身体、嘴型手部和整体运动，跟之前Meta的audio2photoreal很像。用户只要上传音频（小于60秒），然后点击提交，输出结果将在输出中呈现3分钟。

他们引入了新的全面共话数据集 BEATX，该数据集结合了 MoShed SMPLX 身体和 FLAME 头部参数，进一步提高了建模质量，特别是对头部、颈部和手指动作的建模。EMAGE 在训练过程中利用了掩码手势的先验信息，以提高推断性能。该框架包括一个 Masked Audio Gesture Transformer，有助于联合训练音频到手势生成和掩码手势重建，有效地编码音频和身体手势提示。从掩码手势中编码的身体提示随后分别用于生成面部和身体动作。

此外，EMAGE 自适应地合并了音频的节奏和内容的语音特征，并利用了四个组合 VQ-VAE 来增强结果的保真度和多样性。实验证明，EMAGE 具有最先进的性能，能够生成具有完整的、音频同步的整体手势。

EMAGE 技术的问世将在各个领域产生深远影响，其中包括但不限于教育、医疗、娱乐等领域。研究团队表示，他们的代码和数据集已经公开提供，供学术和工业界使用。

项目入口：https://top.aibase.com/tool/emage

在线体验:https://huggingface.co/spaces/H-Liu1997/EMAGE

Tags：

上一篇：回南天有多潮：两广地区家里水帘洞户外南天门北方人侧目

下一篇：一高铁因超载无法运行网友：这场景只有春运才能见到吧

腾讯出行推出顺风车春节返乡互助功能：一键发布拼车信息
短视频
快科技2月3日消息，春节将至，回家过年成为异乡人的头等大事。每年春运期间，无论是飞机、火车还是客运大巴往往一票难求，顺风车成了大家主要选择之一。对此，腾讯出行近日正式推出了助力返乡活动，方便大家发布打 ...

2024-07-06 17:31【短视频】
阅读更多
雷军分享早餐后的评论区笑死人：千亿富翁同款早餐
短视频
CSS站长资源ChinaZ.com）6月14日消息:在社交媒体平台上，小米科技创始人雷军近日发布了一段视频，与网友们分享了他的日常点滴。视频中，雷军驾驶着全新的小米SU7Max霞光紫车型驶入小米园区 ...

2024-07-06 16:04【短视频】
阅读更多
完全自研不兼容安卓！曝华为鸿蒙星河版6月21日开启Beta
短视频
快科技6月14日消息，6月21日至23日，华为将在深圳举办华为开发者大会2024，届时，HarmonyOSNEXT鸿蒙星河版与盘古大模型5.0将首次同台亮相。日前，数码博主定焦数码”晒出一张与华为客服 ...

2024-07-06 15:49【短视频】
阅读更多

您现在的位置是：短视频 >>正文

EMAGE：上传音频就能生成全身动作包括头部、嘴型、身体运动

相关文章

腾讯出行推出顺风车春节返乡互助功能：一键发布拼车信息

雷军分享早餐后的评论区笑死人：千亿富翁同款早餐

完全自研不兼容安卓！曝华为鸿蒙星河版6月21日开启Beta

热门文章

最新文章

友情链接

您现在的位置是：短视频 >>正文

EMAGE：上传音频就能生成全身动作 包括头部、嘴型、身体运动

相关文章

腾讯出行推出顺风车春节返乡互助功能：一键发布拼车信息

雷军分享早餐后的评论区笑死人：千亿富翁同款早餐

完全自研不兼容安卓！曝华为鸿蒙星河版6月21日开启Beta

热门文章

最新文章

友情链接

EMAGE：上传音频就能生成全身动作包括头部、嘴型、身体运动