语音驱动下的数字人唇形、表情和肢体动作一体化视频生成研究与应用

Campus

Company Jd

Focus Tech · Algorithm

Location 北京

Published July 20, 2026

岗位职责

  1. 负责数字人大模型、人物视频AIGC等生成式AI技术的研发,在数字人视频生成效果、效率、长时序一致性和高分辨率下取得突破性进展;
  2. 拓展数字人视频大模型泛化边界,提升模型在卡通角色和动物等形象上的泛化性;
  3. 与产品部门密切合作,进行模型推理加速和并发优化,结合工程手段进行模型落地应用,满足实际业务中的效果、实时性和高并发要求,提高数字人技术产品的业务效果;
  4. 关注前沿技术的最新进展和未来发展趋势,提出创新的研究思路,规划阶段性的技术成果。

任职要求

  1. 获得本科及以上学历,计算机科学、人工智能、自动化、数学、物理、软件工程等相关专业;
  2. 具备数字人、视频AIGC及生成式模型(如Diffusion、DiT等)的专业知识与实际应用经验;
  3. 拥有卓越的工程实现能力,熟悉大规模分布式模型训练,能够快速复现前沿论文方法与实验结果;
  4. 在机器学习或深度学习领域的顶级学术会议(如ICLR、CVPR、ICML等)上有高质量论文发表记录者优先;
  5. 具备优秀的团队协作与沟通能力,能够有效跨团队协同并推进项目研发进程。

部门/板块

京东科技