大模型训练专家(Agent方向)
Company Kuaishou
Focus Tech · Algorithm
Location 北京
Published May 19, 2026
岗位职责
1、参与 LLM Agent 的预训练与后训练优化,提升模型在任务理解、指令跟随、多轮对话、工具调用等方面的表现; 2、对模型输出进行评测与误差分析,识别在幻觉、漏召回、格式偏差、工具误用、指令偏移、安全风险等方面的问题,并推动改进; 3、围绕Agent使用场景,设计multi-turn conversation、任务流程和工具使用样本,优化Agent 在复杂任务中的完成率与鲁棒性; 4、设计并构建高质量训练数据、评测集和对话样本,覆盖真实业务中的典型场景、边界场景与异常案例。
任职要求
1、计算机相关专业硕士及以上学历,研究方向为自然语言处理、机器学习、深度学习等相关方向,或者在该领域有相关工作经验,精通Python编程,熟悉Java/C++中至少一门语言; 2、能够针对模型“不 work”的情况,从训练数据质量、任务定义、Prompt 设计、评测标准、奖励机制、工具调用链路、推理参数、模型对齐策略等多个维度进行拆解和诊断; 3、熟悉常见模型问题,包括但不限于幻觉、指令跟随不稳定、格式不一致、任务完成率低、工具误用等,并能结合bad cases进行分析和迭代; 4、了解阅读理解、序列标注、文本生成、文本分类等传统NLP任务,精通PyTorch/TensorFlow等训练框架,可以自己构造小模型验证算法有效性,并具备Qwen、Llama、Deepseek等模型的后训练实操经验。 加分项: 1、在ACL、EMNLP、NeurIPS、ICLR、ICML、KDD 等国内外顶级会议/期刊有相关论文发表者优先; 2、有大模型后训练(Post-training)相关项目经验者优先,尤其是在国内外头部科技公司或知名AI团队的实际工作经历; 3、具有扎实的深度学习算法基础,熟悉深度学习框架和分布式训练推理加速,有实操经验者优先。