大语言模型攻击发现与对抗技术研究
Campus
Company Jd
Focus Tech · Other
Location 北京
Published August 17, 2026
岗位职责
- 负责大模型核心技术体系研究,深入掌握基座模型推理机制、上下文理解与能力调用等底层原理,开展安全攻防研究与风险挖掘。
- 系统性攻坚AI应用前沿安全威胁,聚焦提示对抗、语义越狱、隐式攻击、越权调用、指令劫持及环境逃逸等风险方向。
- 针对在线推理服务、多智能体协作及工具调用等业务形态,主导定向红队攻击测试与未知漏洞挖掘,梳理场景化攻击链路与风险机理。
- 研发推理侧轻量化、无侵入式防御方案,攻坚Agent场景下的权限管控、行为校验、工具隔离、意图识别及风险拦截技术。
- 持续跟踪全球大模型与Agent安全前沿技术,负责算法复现与创新,搭建适配全场景的攻击样本库、检测模型与攻防评测体系。
任职要求
- 计算机、人工智能、网络安全等相关领域的本硕博在校生,扎实掌握Transformer架构原理、大模型底层运作与推理机制。
- 具备深厚的大模型技术功底,深刻理解指令遵循、上下文交互及思维链等核心机理,能够从模型行为层级精准分析安全风险。
- 熟练掌握大模型攻防技术体系,深入理解提示对抗、越狱劫持及隐式诱导等攻击手法,具备独立构建高阶隐蔽攻击样本的能力。
- 熟悉主流AI安全防御方案,涵盖推理侧风险检测、内容安全风控、Agent权限隔离、意图校验及动态行为管控等策略。
- 保持对AI安全前沿技术的持续追踪,具备出色的漏洞挖掘、逻辑推演与自驱研究能力,以及良好的跨团队协作与推动意识。
- 在安全领域四大顶会(USENIX Security、IEEE S&P、ACM CCS、NDSS)或AI顶级会议(NeurIPS、ICML、ICLR等)发表过高质量论文,有顶级安全会议(如Black Hat、DEF CON)议题演讲经历,或作为核心成员深度参与过AI安全知名开源项目者优先。
部门/板块
京东集团