Token Foundry-模型自进化算法专家-Qwen模型训练
Company 通义实验室
Focus 技术 · 算法
北京, 杭州
July 29, 2026
岗位职责
- 围绕模型自进化方向开展算法研究与系统研发,探索大模型能力自动演进的关键路径。
- 聚焦Agent任务,为模型注入自动迭代RL/SFT训练数据的能力,包括Agent环境/query/verifier合成、筛选、训练、反馈闭环优化,通过多轮迭代提升训练数据质量。
- 为模型注入自动挖掘CPT/PT训练数据的能力,提升预训练和持续训练数据的知识覆盖度、有效性与任务适配性。
- 为模型注入自动化训练与自动化Infra调优能力,包括Verl、Megatron等框架的训练策略优化、RL超参搜索、训练稳定性提升、SGLang、vLLM推理效率优化等,提升模型研发效率和性能上限。
- 研究基于self-evolving、long-horizon等范式的能力增强方法,提升模型在自迭代任务中的长期规划、任务分解、多步执行与自主反馈优化能力。
- 跟踪相关领域前沿进展,结合实际问题开展算法创新、实验验证和系统落地,沉淀可复用的方法与能力。
任职要求
- 计算机、人工智能、自动化等相关专业本科及以上学历,硕士/博士优先。
- 具备扎实的机器学习、深度学习基础,熟悉大模型训练、对齐、微调或推理优化相关技术。
- 实现过有效的自动化数据构造Pipeline优先。
- 实现过自动化训练、超参数优化、训练系统或推理框架优化优先。
- 极强的求知欲与学习能力,对新技术保有好奇心;逻辑清晰,善于独立思考并反思总结;具备良好的沟通能力和团队协同意识。
- 熟悉Python;具备较强的工程实现能力。
- 具备较强科研能力或技术产出能力,有高水平论文、开源项目、竞赛成绩或实际落地成果者优先。
岗位标签
NEW