智能引擎-PostTrain框架研发工程师-AI Infra
Company 阿里巴巴
Focus 技术 · 算法
北京, 杭州
July 30, 2026
岗位职责
我们关注大模型后训练系统,为提升智能体能力上限、AIGC应用提供算力基座,加入我们迎接以下挑战:
- 支持百亿~万亿规模的稠密 / MoE大模型的强化学习训练,实现多种对齐算法,增强大模型对齐人类模态、数学、代码、推理等方面的能力
- 极致的通过5D并行训练、推理加速、训推一体复用等技术,与前沿的强化学习算法团队和阿里硬件团队进行协同设计,在前沿异构系统上实现高效的大规模(千卡以上)强化学习训练
- 使用强化学习、蒸馏、量化等后训练技术,在AIGC、实时生成等场景达到极致的模型效果-性能平衡点;
- 将成熟的系统与算法成果发表于顶会,并回馈开源社区(如 ROLL),持续提升在学术界与产业界的影响力
- 支持业界前沿的LLM、多模态、图/视频生成模型在AI创新场景的业务落地。
任职要求
- 有扎实的工程算法基础,精通数据结构和常用算法,熟练掌握GDB / Nsight等调试和性能分析工具。精通Python、C/C++语言;
- 精通PyTorch / Megatron-LM等业界主流深度学习引擎内核,精通ROLL / VeRL / Slime等强化学习框架实现者优先,精通vLLM / SGLang / TensorRT-LLM等大模型推理引擎优化者优先;
- 有大模型分布式训练经验者,对训练系统中精度、性能、效果问题排查有经验者优先;
- 有大模型对齐/RL算法相关经验优先,包括但不限于:PPO / DPO / GRPO等;有AIGC模型加速从数据到训练经验优先,包括但不限于:蒸馏、量化、稀疏Attention等;
- 有优秀开源项目开发经验优先,特别是业界主流深度学习训练/推理引擎。有系统顶会发表优先;包括但不限于: OSDI / SOSP / NSDI / ATC / EuroSys / MLSys;
岗位标签
NEW