腾讯游戏-多模态大模型算法研究员-动作生成方向
Company Tencent
Focus Tech · Algorithm
Location 深圳
Published September 22, 2026
岗位职责
- 负责构建和优化面向动作生成的多模态大模型架构,探索文本、视觉信号、3D 动作序列等模态的深度融合与对齐;
- 负责研究多模态场景下,高维、连续3D动作数据的Tokenization 方法;
- 负责探索多模态动作大模型 Scaling Law,包括数据量、参数量级、计算量等,通过模型规模化提升生成能力;
- 负责探索多模态对齐大模型,支持语音、文本、动作等多模态对齐,未来进一步支持多模态实时输出;
- 负责探索任意角色动画生成,可对任意角色与骨架均能生成自然的动画;
- 负责探索、研发动捕精修大模型,可对动捕过程各类噪声自动去除,达到精修品质;
- 负责探索环境感知的交互动画生成,支持角色与物体、场景、其他角色的交互,确保生成交互动作的合理性。
任职要求
- 计算机、人工智能等相关专业硕士或博士学位,在深度学习领域有扎实的理论功底;
- 深入理解主流多模态融合架构(例如 Single-stream、Double-stream 等),能够针对不同模态特征进行灵活的 Transformer 模块设计;
- 熟悉端到端预训练、SFT、RL 微调等流程;
- 熟练使用 Python,熟练使用 PyTorch 框架;
- 具备 3D 骨骼动画或人体运动学(IK/FK, SMPL 等人体参数化模型)相关经验者优先;
- 具备人体物理仿真(如 PhysX, Isaac Gym, MuJoCo)或基于强化学习的动作控制经验者优先;
- 在 CVPR、ICCV、ECCV、SIGGRAPH 等顶会发表过高质量论文,或在相关开源项目、算法竞赛中获得优异成绩者优先;
- 具备极强的论文复现与改进能力,能够敏锐捕捉大语言模型、视频生成领域的最新技术并将其迁移至动作生成领域。
产品/项目
Aivatar_动画生成(孵化)
工作年限
两年以上工作经验