AI 安全技术专家 / 大模型安全工程师
Company 京东
Focus 技术 · 安全
北京
July 12, 2026
岗位职责
部门介绍 我们是京东科技,作为京东集团旗下专注于以技术为产业服务的业务子集团,秉承“以科技引领产业数智化升级,推动世界更加高效和美好”的使命,为企业和金融机构等客户提供全链条的技术产品与服务。
岗位职责
- 建设大模型安全识别与防护能力:面向用户输入、模型输出、多轮对话、AIGC 生成内容、多模态内容等场景,参与建设输入安全、输出安全、上下文安全、情感陪伴安全、未成年人保护、数字人安全等能力模块;结合规则、分类模型、LLM-as-Judge、RAG、Agent、向量检索等技术,探索可落地的大模型安全防护方案;
- 参与安全评测与 benchmark:体系建设参与构建安全 benchmark、人工金集、边界样本库、badcase 库和回归测试集。针对业务场景,设计风险评测维度和自动化评测流程;对模型误判、漏判、过度拒答、幻觉、越狱、提示词注入、多轮风险升级等问题进行分析和归因;建设模型评测指标体系,包括召回率、准确率、误伤率、漏放率、一致率、过度拒答率等;
- 推动线上安全能力落地:参与设计自建 guardrail 的线上旁路 / shadow 双跑方案。支持安全策略灰度、效果监控、样本回流和模型迭代闭环;与产品、策略、算法、工程、审核标注团队协作,将安全能力接入真实业务流程。基于线上 case 和人审反馈,持续优化安全模型、规则策略和干预机制;
- 负责安全数据与模型迭代闭环:基于业务风险 case,设计数据标注规范、风险标签体系和样本回收机制。将人审 badcase、模型误判样本、边界样本转化为可用于评测、训练和策略优化的数据资产参与安全分类器、模型裁判、风险识别模型、prompt 评测工具等能力建设。支持数据清洗、样本构造、自动化打标、标注一致性校验和质量分析;
- 跟踪大模型安全技术发展:跟踪 AI safety、LLM guardrails、red teaming、prompt injection、jailbreak、多模态安全、Agent 安全等方向进展;调研业内安全方案、开源工具、评测框架和竞品策略。将前沿技术转化为团队可落地的工程方案和业务能力;
任职要求
任职要求 1.全日制统招硕士及以上学历,数学、计算机科学、人工智能、自然语言处理、数据科学、统计学、信息安全、软件工程等相关专业优先; 2.具备技术研发、算法工程、数据科学、模型评测、安全风控、内容安全或大模型应用相关工作经验;有互联网产品、AI 产品、内容安全、风控系统、推荐/搜索、AIGC 或大模型相关项目经验者优先; 3.技术基础:具备扎实的编程能力,熟悉 Python,能够独立完成数据处理、模型评测、实验分析和工具开发;熟悉常见机器学习 / 深度学习基础概念,如分类、召回、排序、评估指标、样本构造、特征工程、模型训练与验证;熟悉 SQL、数据分析、日志分析、实验评估等基础能力;能够基于真实业务数据进行问题定位、指标分析和效果验证; 4.大模型理解:理解大模型基本概念,包括 prompt、上下文窗口、RAG、SFT、RLHF/RM、模型幻觉、多轮对话、多模态、Agent、tool use 等;能够使用并评估主流大模型产品和 API;理解大模型应用中的典型安全风险,如 jailbreak、prompt injection、诱导生成、越权指令、幻觉误导、过度拒答、多轮风险升级等; 5.安全与业务理解:对 AI 内容安全、平台治理、业务风控或模型安全有兴趣和实践基础;能够理解安全底线、用户体验和业务增长之间的平衡;能将抽象风险转化为可执行的技术方案、评测指标和数据闭环;具备良好的问题拆解、结构化表达和跨团队协作能力;
加分项 1.有大模型安全、AIGC 内容安全、AI red teaming、guardrail、模型评测、LLM-as-Judge、自动化评测相关经验; 2.有内容审核、内容安全策略、未成年人保护、情感陪伴安全、数字人安全、多模态安全经验; 3.有线上风控系统、实时策略系统、模型服务、灰度实验、AB 实验、shadow 双跑经验; 4.有安全分类器、文本分类、多模态分类、风险识别模型、审核辅助模型建设经验; 5.熟悉 prompt engineering、RAG、Agent workflow、向量检索、自动化标注、数据飞轮等技术; 6.熟悉 Python、SQL、Pandas、PyTorch、Transformers、LangChain / LlamaIndex 或类似工具; 7.有论文、专利、开源项目、技术博客或 benchmark 构建经验;
符合京东价值观:客户为先、创新、拼搏、担当、感恩、诚信。
部门
京东科技