LongCat - 基座agent评测分析算法研究员(生产力方向)
Company 美团
Focus 技术 · 算法
北京, 上海
July 28, 2026
岗位职责
负责围绕AI大模型算法的认知分析的研究工作,具体工作内容包括但不限于:
- 深入理解大规模语言模型的模型结构、训练过程以及评测方式,根据模型的训练过程以及评测结果,对大语言模型存在的问题进行研究。
- 深度参与通用生产力在claude code/OpenClaw等场景下的基座模型能力优化迭代,设计具有长路径、多步骤交互特征的评测任务集,实现从“单次问答”到“闭环任务”的评测转型。
- 探索长周期下Agent在复杂任务的能力边界,涵盖工具调用、决策规划和记忆管理等方向,对前沿评测范式如基于沙盒环境的动态评测和多agent协同效率等进行深入研究.
任职要求
- 硕士及以上学历,计算机、数学或相关专业。熟悉Java/Python/C++等编程语言,良好的编码习惯和一定的工程能力 ;
- 具有机器学习或深度学习算法的基础知识,熟练掌握自然语言处理、多模态或大模型相关算法和模型;
- 具备工匠精神,对每一行代码负责,对业务方负责。有良好的沟通合作意识和较强的问题解决能力。