jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

智能引擎-PostTrain框架研发工程师-AI Infra

Company 阿里巴巴

Focus 技术 · 算法

北京, 杭州

July 30, 2026

岗位职责

我们关注大模型后训练系统,为提升智能体能力上限、AIGC应用提供算力基座,加入我们迎接以下挑战:

  1. 支持百亿~万亿规模的稠密 / MoE大模型的强化学习训练,实现多种对齐算法,增强大模型对齐人类模态、数学、代码、推理等方面的能力
  2. 极致的通过5D并行训练、推理加速、训推一体复用等技术,与前沿的强化学习算法团队和阿里硬件团队进行协同设计,在前沿异构系统上实现高效的大规模(千卡以上)强化学习训练
  3. 使用强化学习、蒸馏、量化等后训练技术,在AIGC、实时生成等场景达到极致的模型效果-性能平衡点;
  4. 将成熟的系统与算法成果发表于顶会,并回馈开源社区(如 ROLL),持续提升在学术界与产业界的影响力
  5. 支持业界前沿的LLM、多模态、图/视频生成模型在AI创新场景的业务落地。

任职要求

  1. 有扎实的工程算法基础,精通数据结构和常用算法,熟练掌握GDB / Nsight等调试和性能分析工具。精通Python、C/C++语言;
  2. 精通PyTorch / Megatron-LM等业界主流深度学习引擎内核,精通ROLL / VeRL / Slime等强化学习框架实现者优先,精通vLLM / SGLang / TensorRT-LLM等大模型推理引擎优化者优先;
  3. 有大模型分布式训练经验者,对训练系统中精度、性能、效果问题排查有经验者优先;
  4. 有大模型对齐/RL算法相关经验优先,包括但不限于:PPO / DPO / GRPO等;有AIGC模型加速从数据到训练经验优先,包括但不限于:蒸馏、量化、稀疏Attention等;
  5. 有优秀开源项目开发经验优先,特别是业界主流深度学习训练/推理引擎。有系统顶会发表优先;包括但不限于: OSDI / SOSP / NSDI / ATC / EuroSys / MLSys;

岗位标签

NEW

Apply now

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.