【蚂蚁星】算法工程师-LLM后训练-灵光(实习)

Intern

Company Antgroup

Focus Tech · Algorithm

Location 杭州

Published May 12, 2026

岗位职责

部门介绍: 灵光APP是一款原生多模态的AGI助手,团队致力于构建有竞争力的AGI产品体验。算法团队以用户体验为牵引,为灵光助手构建后训练体系和模型。驱动灵光在智能体验上保持业界领先。

职位描述

  1. 参与设计并实现 代码生成(可视化方向)、Agent等方向的大模型后训练算法;
  2. 结合业务数据和场景,设计Post training的高质量数据构建方案(含数据洞察、数据合成、数据质量优化等)提升模型的应用效果;
  3. 与工程以及产运团队协作,参与或负责大语言模型、多模态大模型等业务场景的后训练端到端效果提升及落地;
  4. 密切关注业界 LLM 微调算法和数据提质领域的前沿论文,并整合新技术和算法到训练引擎中,提升框架的领先性。

任职要求

  1. 在后训练微调领域拥有丰富的项目经验,熟恶DPO、PPO、GRPO、OPSD等算法原理,具备扎实的数学基础,熟悉线性代数、概率统计、优化算法等。;
  2. 对Megatron-LM、DeepSpeed等分布式框架及LLaMA-Factory、ms-swift等大模型微调工具库有一定的了解或相关开发经验;
  3. 具备优秀的算法研发能力,对LLM领域前沿技术有热情,能够自驱地设计丰富的实验并完成论文技术的落地验证;
  4. 拥有良好的沟通表达能力和团队协作精神,具有强烈的责任心和使命感。

加分项:

  1. 在顶级会议或期刊上发表过相关研究论文;
  2. 拥有LLM领域大规模数据处理经验;
  3. 在后训练微调引擎方面具有实战经验;
  4. 有代码大模型的调优经验。

特色标签

Agent系统、AI代理、Megatron框架、Post training、Python、RLHF、VL模型、云原生、代码大模型、代码生成模型、偏好学习、偏好对齐、分布式训练、分布式训练框架、发表算法相关优秀论文、可视化代码生成、合成数据、后训练微调、后训练框架、多模态模型、多模态算法、大数据处理工具(Spark/Hadoop/Hive)、大模型微调库、大模型算法、大模型训练框架、强化学习、微调工具库、微调引擎、微调系统、数据优化、数据增强、数据提质、数据治理、数据清洗、数据生成、智能交互、智能体、有留学背景、模型加速/性能优化、模型微调、模型微调框架、模型精调、模拟数据、深度学习、直接偏好优化、算法工程化经验、编程助手、聊天机器人、自主代理、自然语言处理算法、视觉语言模型、训练工具箱、训练引擎、跨模态模型、金融