研究型实习生-医疗安全-DeepResearch
Company Antgroup
Focus Tech · Security
Location 上海, 杭州
Published May 28, 2026
岗位职责
研究领域: 大模型智能体 项目简介: 医疗安全场景是蚂蚁大安全体系的重要前沿阵地,支撑阿福、好大夫等多类核心医疗服务场景。随着医疗与医药服务加速专业化、数字化演进,风险形态日益复杂。需要依托智能化技术体系,快速沉淀医疗安全识别、理解与处置能力,构建在线实时防护闭环,为医疗场景的规模化发展提供安全底座。
任职要求
职位描述 1、负责复杂医疗专业安全场景下DeepResearch Agent的设计、构建与持续优化,围绕任务规划、检索策略设计、工具调用、证据整合、推理决策等关键环节开展研发,提升模型在复杂场景中的深度分析能力、结果准确性与过程可追溯性。 2、参与Agent 的训练与优化,探索并落地SFT、轨迹学习、on-policy优化等方法,提升模型在长链路推理、多轮检索、复杂任务求解等场景下的稳定性、泛化能力与最终效果。 3、参与DeepResearch体系建设与,持续推动模型与系统迭代优化;跟踪并研究Agent、Reasoning、Agentic RL等前沿方向,推进相关能力在业务场景中的应用落地。
职位要求 1、计算机、数学、统计学、人工智能或相关专业博士在读。 2、具备半年及以上大模型算法相关研究或实践经验,熟悉大模型训练、微调、推理优化等至少一个方向,具有较强的实验设计、问题分析与结果归因能力。 3、熟悉RAG、CoT、Tool Use、Agent等相关技术方案,在多步推理、检索增强、工具调用或 Agent 系统开发方面有实际经验。 4、具备良好的论文阅读、问题抽象与研究推进能力,能够独立开展实验设计、实现与分析。 5、实习周期不少于6个月,工作地点杭州。 6、在机器学习、自然语言处理、计算机视觉或人工智能相关领域顶级会议/期刊发表过论文者优先。
特色标签
AI智能体、Python、任务编排、信息融合、医疗、医疗风控、医疗风险治理、发表算法相关优秀论文、可解释推理、外部工具调用、多步推理决策、多源证据聚合、大模型算法、大语言模型智能体、安全、工具集成、强化学习、推理路径规划、智能体、有监督微调、检索优化、检索增强生成、检索增强问答、深度研究智能体、深研智能体、监督微调、算法工程化经验、自然语言处理算法、自适应检索、风控算法