研究型实习生-事实核查benchmark建设

Intern

Company Antgroup

Focus Tech · Other

Location 杭州

Published June 2, 2026

岗位职责

研究领域: 自然语言处理 项目简介: Deepresearch能力是agentic模型的重要战场之一,对于事实核查场景,deepresearch也是必备技能。通过多轮搜索/校验/反思,模型可以获得更加真实,有效的结论。事实核查领域的benchmark较少,且大多数区分度不大,我们希望建设更权威,更有效的benchmark提升该场景的影响力。

任职要求

职位描述

  1. 负责应用场景的Agent的构建,包括Agent的结构设计等,提升其深度分析能力和准确性;
  2. 负责Agent模型优化、评估、迭代等;

职位要求:

  1. 计算机、数学或统计学相关专业硕士及以上学历;
  2. 1年以上大模型算法相关经验,熟练掌握各种大模型预训练和微调等训练方法;
  3. 熟悉RAG、COT等技术方案,有Agent开发经验;
  4. 熟练使用Python或者java等编程语言,有pytorch等深度学习框架使用经验;
  5. 熟练使用ai code工具;
  6. 要求实习时间6个月以上;base杭州;

符合以下条件之一者优先: a) 有Agentic RL的优化经验; b) 在机器学习/CV/NLP/人工智能相关领域发表过顶会论文或者Kaggle等重要赛事获取top; c) 对DeepResearch等Agent方案有深度理解和应用;

特色标签

Java、LLM、NLP、Python、事实验证、代理模型、参加算法相关竞赛/获奖、发表算法相关优秀论文、基准测试、大模型算法、大语言模型、强化学习、思维链、意图挖掘、推理链、摘要生成、文本生成、智能体、有监督微调、检索增强型大模型、检索增强生成、模型微调、深度检索、深度研究、真实性验证、算法工程化经验、自监督预训练、评测基准、语义理解、预训练模型