蚂蚁集团-大模型后训练专家-CPO线

Company Antgroup

Focus Tech · Algorithm

Location 杭州

Published July 10, 2026

岗位职责

  1. 负责HR业务场景的大模型后训练工作,包括:样本构造、模型微调、效果迭代等环节;
  2. 负责HR业务场景的Agent自主学习工作,包括:自动识别badcase、自动归因、合成样本数据、动态构建评测集等。

任职要求

  1. 有2~5年的大模型后训练经验,专业不限(计算机/软工/数学等相关背景更易上手) ;
  2. 大模型相关经验,包括但不限于模型微调、强化学习等;
  3. 对AI有朴素的热情,有AI信仰,愿意用AI重构业务场景。

特色标签

AI代理自主学习、Python、不良案例、人力资源、人工合成数据、低质量案例、分布式训练、动态评测集构建、可演进评测集、合成数据、合规、后训练、大模型微调、大模型算法、强化学习、归因分析、微调、数据安全、数据构造、智能体、智能体自主学习、智能研发、样本生成、根因自动识别、模型后训练、模型精细化调整、生成式样本、研发效能、算法工程化经验、细调、聊天机器人、自主学习Agent、自动原因分析、自然语言处理算法、自适应评测集、训练样本构建、金融、错误案例、隐私计算