研究型实习生-事实核查benchmark建设
Company Antgroup
Focus Tech · Other
Location 杭州
Published June 2, 2026
岗位职责
研究领域: 自然语言处理 项目简介: Deepresearch能力是agentic模型的重要战场之一,对于事实核查场景,deepresearch也是必备技能。通过多轮搜索/校验/反思,模型可以获得更加真实,有效的结论。事实核查领域的benchmark较少,且大多数区分度不大,我们希望建设更权威,更有效的benchmark提升该场景的影响力。
任职要求
职位描述: 1、负责应用场景的Agent的构建,包括Agent的结构设计等,提升其深度分析能力和准确性; 2、负责Agent模型优化、评估、迭代等;
职位要求: 1、计算机、数学或统计学相关专业硕士及以上学历; 2、1年以上大模型算法相关经验,熟练掌握各种大模型预训练和微调等训练方法; 3、熟悉RAG、COT等技术方案,有Agent开发经验; 4、熟练使用Python或者java等编程语言,有pytorch等深度学习框架使用经验; 5、熟练使用ai code工具; 6、要求实习时间6个月以上;base杭州;
符合以下条件之一者优先: a) 有Agentic RL的优化经验; b) 在机器学习/CV/NLP/人工智能相关领域发表过顶会论文或者Kaggle等重要赛事获取top; c) 对DeepResearch等Agent方案有深度理解和应用;
特色标签
Java、LLM、NLP、Python、事实验证、代理模型、参加算法相关竞赛/获奖、发表算法相关优秀论文、基准测试、大模型算法、大语言模型、强化学习、思维链、意图挖掘、推理链、摘要生成、文本生成、智能体、有监督微调、检索增强型大模型、检索增强生成、模型微调、深度检索、深度研究、真实性验证、算法工程化经验、自监督预训练、评测基准、语义理解、预训练模型