jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

Token Foundry-模型自进化算法专家-Qwen模型训练

Company 通义实验室

Focus 技术 · 算法

北京, 杭州

July 29, 2026

岗位职责

  1. 围绕模型自进化方向开展算法研究与系统研发,探索大模型能力自动演进的关键路径。
  2. 聚焦Agent任务,为模型注入自动迭代RL/SFT训练数据的能力,包括Agent环境/query/verifier合成、筛选、训练、反馈闭环优化,通过多轮迭代提升训练数据质量。
  3. 为模型注入自动挖掘CPT/PT训练数据的能力,提升预训练和持续训练数据的知识覆盖度、有效性与任务适配性。
  4. 为模型注入自动化训练与自动化Infra调优能力,包括Verl、Megatron等框架的训练策略优化、RL超参搜索、训练稳定性提升、SGLang、vLLM推理效率优化等,提升模型研发效率和性能上限。
  5. 研究基于self-evolving、long-horizon等范式的能力增强方法,提升模型在自迭代任务中的长期规划、任务分解、多步执行与自主反馈优化能力。
  6. 跟踪相关领域前沿进展,结合实际问题开展算法创新、实验验证和系统落地,沉淀可复用的方法与能力。

任职要求

  1. 计算机、人工智能、自动化等相关专业本科及以上学历,硕士/博士优先。
  2. 具备扎实的机器学习、深度学习基础,熟悉大模型训练、对齐、微调或推理优化相关技术。
  3. 实现过有效的自动化数据构造Pipeline优先。
  4. 实现过自动化训练、超参数优化、训练系统或推理框架优化优先。
  5. 极强的求知欲与学习能力,对新技术保有好奇心;逻辑清晰,善于独立思考并反思总结;具备良好的沟通能力和团队协同意识。
  6. 熟悉Python;具备较强的工程实现能力。
  7. 具备较强科研能力或技术产出能力,有高水平论文、开源项目、竞赛成绩或实际落地成果者优先。

岗位标签

NEW

Apply now

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.