大模型Search Agent实习生

Intern

Company Meituan

Focus Tech · Algorithm

Location 北京, 上海

Published September 20, 2026

岗位职责

你将加入 LongCat Agent 算法团队,与一线研究员共同推进下一代智能体的范式探索。具体方向包括但不限于:

  1. Agentic RL 基础算法研究:探索面向长程多步任务的强化学习训练范式,包括稀疏奖励下的信用分配、过程奖励建模、自我博弈与多智能体协同、可扩展的 reward modeling,以及训练稳定性与样本效率优化。目标是实现Agent 能力增长的主引擎;
  2. Search Agent 能力构建:研发面向开放域复杂查询的搜索智能体,覆盖多轮检索规划、查询改写、证据聚合、多源信息冲突消解与可信溯源。重点突破"深度研究"类长程任务(Deep Research)的端到端 RL 训练,让模型在数十步检索-推理交织中保持目标产出高质量分析内容。
  3. 生活服务助理 Agent:解决美团真实业务环境中(餐饮、出行、到店、履约等多业务横跨)实现智能助理的基础问题,研究多工具长链调用、澄清和主动服务、个性化记忆与偏好建模、跨会话状态管理,以及面向真实用户反馈的RL 闭环。这里的复杂度来自亿级用户、千万级 SKU 与多步骤决策构成的真实环境。

任职要求

  1. 计算机科学、人工智能、数学或相关领域博士或硕士;
  2. 在 NeurIPS、ICML、ICLR、ACL、EMNLP等大模型领域顶级会议发表过论文,研究方向与大语言模型、强化学习、Agent、多模态模型等强相关;
  3. 在大语言模型、强化学习、Agent、多模态等方向中至少一个领域有扎实的理论基础与实践经验,能独立完成从问题定义、方法设计、系统开发、实验验证的完整工作闭环,并深度使用AI工具辅助完成;
  4. 扎实的代码功底,能高效准确实现复杂模型结构并完成大规模训练实验;
  5. 具备良好的科研品味、独立思考能力与跨团队协作沟通能力,对前沿问题有持续热情,敢于挑战现有范式。