【蚂蚁星】算法工程师-Agent-大安全-27届

Campus

Company Antgroup

Focus Tech · Algorithm

Location 杭州

Published May 14, 2026

岗位职责

  1. 从“能说”到“能做”:建设UI操作智能体,跨端完成长程操作任务,完成复杂多模态生成任务;
  2. 对抗性社会博弈:在高对抗性复杂环境下,基于目标导向的对话博弈(Goal-Oriented Dialogue Games),突破简单的“预测下一个字”,研究如何将“长期潜伏目标”分解为多轮对话中的微观策略;
  3. 多智能体强化学习与自博弈:构建模拟黑产对抗的沙盒环境,利用自博弈技术让模型在虚拟博弈中自动习得更高级的情报获取策略与防御手段;
  4. 长上下文与动态内存管理:针对数月甚至数年的“潜伏”任务,研究模型如何高效压缩、检索和更新长程记忆,确保身份信息在海量对话中不丢失、不冲突。

任职要求

  1. 计算机相关专业在读博士或硕士;
  2. 有较好的计算机科学和算法基础,编程能力强,熟练使用分布式训练/推理框架;
  3. 有多模态大模型、强化学习等相关技术或者落地经验者优先;
  4. 产出需在论文、开源、比赛成绩、项目上满足以下至少两条;
  • a、在诸如ICML/ICLR/NIPS、ACL、CVPR/ICCV等会议有相关论文发表者优先;
  • b、在顶会组织或者行业组织且有广泛影响的比赛或benchmark取得好成绩者优先;
  • c、有开源项目影响力或者参与过开源项目者优先;
  • d、有作为主力推动或者参与的有较大影响的项目结果产出。
  1. 有相关实习经历者优先;
  2. 较强的表达和沟通能力,工作认真、严谨、敬业。有强烈的责任心和自驱力。

特色标签

MARL、Python、UI智能体、内容安全、内生博弈学习、分布式训练、动态记忆管理、博弈型对话系统、参加算法相关竞赛/获奖、发表算法相关优秀论文、可演化记忆机制、多主体强化学习、多智能体RL、多模态内容生成、多模态算法、多模态输出任务、大模型算法、安全、安全仿真环境、对抗模拟环境、对话式目标达成、并行计算、延时触发目标、强化学习、数据安全、机器学习、深度学习、潜伏式任务目标、用户界面智能代理、界面操作智能体、目标驱动对话、算法工程化经验、网络安全、自我对弈、自我对抗训练、自然语言处理算法、超长上下文建模、跨模态生成、长周期任务、长文本上下文、长时序操作任务、长期隐蔽目标、长程上下文理解、长程记忆更新、长跨度交互任务、风控算法、黑产模拟沙盒