EMAGE
CVPR 2024 | 面部+肢体动画,一个框架搞定从音频生成数字人表情与动作
AI 数字人面部与肢体的驱动算法作为数字人研发的重要环节,可以大幅度降低 VR Chat、虚拟直播和游戏 NPC 等领域中的驱动成本。近年来,基于语音生成面部、肢体和手部的动作的各类独立基线模型已经逐渐成熟。然而,直接将不同模型的动画结果混合会导致最终全身整体的动画不协调。研究者逐渐考虑使用统一的框架来同时生成面部表情和肢体动作。然而,尽管研究社区在面部的表情和肢体的动作上分别存在统一的数据标准,已有的基线模型仅在独立的数据格式上进行训练和评估,比如 FLAME (面部) 和 AMASS (肢体)。社区仍然缺少面向
4/1/2024 11:11:00 AM
机器之心
- 1
资讯热榜
DeepSeek R1 简易指南:架构、本地部署和硬件要求
DeepSeek 全面指南:95% 的人都不知道的九个技巧
硅基流动×华为云联合推出基于昇腾云的DeepSeek R1&V3推理服务
DeepSeek开源多模态模型Janus-Pro的ComfyUI使用教程,文中附模型和工作流下载
冲击DeepSeek R1,谷歌发布新一代Gemini全型号刷榜,编程、物理模拟能力炸裂
DeepSeek V3 和 R1 模型完成海光 DCU 国产化适配并正式上线
不到140块!李飞飞团队超低成本复刻DeepSeek R1推理!16张H100只训练了26分钟,与R1训练方法不同!
香橙派发布 AI Studio Pro 算力卡华为昇腾开发板,13606 元起
标签云
人工智能
AIGC
OpenAI
AI绘画
ChatGPT
机器人
数据
谷歌
智能
学习
Midjourney
大模型
GPT
用户
AI创作
微软
图像
开源
Meta
技术
论文
Stable Diffusion
生成式
算法
蛋白质
马斯克
芯片
AI
计算
Gemini
神经网络
代码
AI设计
研究
DeepSeek
Sora
腾讯
3D
开发者
场景
GPU
伟达
预测
英伟达
模态
华为
机器学习
Transformer
文本
驾驶
神器推荐
AI视频
深度学习
干货合集
搜索
AI for Science
LLaMA
算力
苹果
视频生成
2024
科技
百度
Copilot
应用
AI应用场景
安全
具身智能
写作
特斯拉
机器
模型
字节跳动
视觉
语音
Anthropic
AGI
架构
prompt
英特尔