【蚂蚁星】算法工程师-搜索智能体-大安全-27届
Company Antgroup
Focus Tech · Algorithm
Location 北京, 杭州
Published May 14, 2026
岗位职责
部门介绍:
我们是蚂蚁集团大安全机器智能Agent团队,一支兼具顶尖学术视野与工业落地能力的研究团队。团队在国际顶会发表多篇论文,具备深厚的研究积累。拥有千卡级训练集群,支持最前沿的大模型探索与实验。同时依托支付宝丰富的业务场景,研究成果可直接转化为实际产品价值。在这里,你将与顶尖研究员和工程师协作,兼顾学术影响力与业务影响力。
职位描述:
当前大模型已进入"Agent时代",Agentic AI正成为最具确定性的技术演进方向。与静态的问答模型不同,Agent具备自主规划、工具调用、长程决策的能力,是连接"智能"与"行动"的关键桥梁。头部玩家正全力押注Agent赛道,产业爆发在即。
核心方向:
- 前沿方向探索:如果你有自己坚信的Agent技术路线或创新想法,我们提供充足的资源和自由度,支持你来定义下一个突破方向。
- Agentic 数据合成:探索高难度、复杂数据的规模化合成技术,突破真实数据稀缺瓶颈,为Agent训练提供高质量燃料;
- Agentic强化学习(RL):针对长程任务设计新型RL算法,解决稀疏奖励、信用分配、探索效率等核心挑战,提升Agent的决策与执行能力;
- Multi-Agent 协同:探索多智能体协作机制,研究分工、通信、博弈与共识达成,构建更强大的群体智能系统。
任职要求
1.计算机科学、人工智能等相关专业博士或优秀硕士(博士优先),在LLM、强化学习、Agent等方向有深入研究或相关项目经验者优先; 2. 在国际顶级会议(如ICML、NeurIPS、ICLR、SIGIR、ACL等)以第一作者发表论文者优先; 3. 熟悉LLM Infra和相关LLM训练框架(如ms-swift、slime、verl、Megatron等)优先。
特色标签
Agent RL、AI智能体、AI智能体数据生成、Python、RL、主动式AI、代理式人工智能、代理强化学习、代理数据构建、代理系统、分布式训练、发表算法相关优秀论文、多代理协同、多智能体协作、大模型、大模型算法、大语言模型、并行计算、强化学习、强化学习算法、搜索、搜索Agent、搜索代理、搜索智能系统、搜索算法、智能体、智能体AI、智能体强化学习、智能体数据合成、深度学习、算法工程化经验、群体智能系统