语音驱动下的数字人唇形、表情和肢体动作一体化视频生成研究与应用

Campus

Company Jd

Focus Tech · Algorithm

Location 北京

Published July 20, 2026

岗位职责

  1. 负责数字人大模型与人物视频AIGC生成技术的底座研发,突破长时序一致性与高分辨率的技术瓶颈。
  2. 深度探索语音驱动下的唇形、表情与肢体动作一体化生成,拓展数字人模型在卡通、动物等多元形象上的泛化边界。
  3. 协同产品与工程团队进行模型推理加速与并发优化,确保技术底座满足业务高并发与实时性的苛刻要求。
  4. 追踪生成式AI的前沿技术趋势,提出创新性研究思路并规划阶段性的高质量技术成果落地。

任职要求

  1. 计算机科学、人工智能、自动化或数学等相关领域的本硕博在校生。
  2. 具备扎实的生成式AI基础,深入掌握数字人生成、视频AIGC及Diffusion/DiT等核心模型架构。
  3. 具备卓越的工程落地能力,拥有大规模分布式模型训练实战经验。
  4. 具备优秀的学术前沿跟踪能力,能快速复现顶会论文算法并与跨部门团队高效协作。
  5. 在机器学习或深度学习领域的顶级学术会议(如ICLR、CVPR、ICML等)有论文发表经历者优先。

部门/板块

京东科技