jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

千问事业部-大模型内容安全算法高级专家-北京

Company 夸克&千问

Focus 技术 · 安全

北京

July 29, 2026

岗位职责

1、负责大模型内容安全防控体系的架构设计与落地,覆盖模型训练、服务上线到内容生成与传播的全链路风险管控。聚焦安全后训练技术路线,通过SFT、RLHF等对齐方法改进安全模型在内容安全场景下的效果,包括大规模数据合成、训练策略优化、自适应推理及可扩展知识注入等; 2、主导大模型安全后训练全链路研发与优化,包括:安全对齐训练数据的设计、合成与质量评估;奖励模型的构建与迭代;SFT/PPO/DPO/GRPO等后训练策略的设计与调优;安全对齐评测体系搭建。通过系统化后训练Pipeline,持续提升模型在风险内容识别、越狱攻击防御、有害意图判别、多轮对话安全等场景的对齐与泛化能力; 3、构建基于大模型能力的自动化风险挖掘与红队测试体系。利用LLM/VLM自动生成对抗样本、合成长尾风险场景,通过自我博弈与持续进化主动发现线上安全盲区与新型攻击模式,实现从“被动拦截”到“主动治理”的转变。搭建分钟/小时级闭环的自动迭代机制,覆盖新增风险的快速响应与模型热更新; 4、建立高危风险内容的快速识别与拦截机制,针对突发舆情或新型攻击,小时级完成策略迭代与模型热更新,确保业务零重大安全事故。保障大语言模型产品、多模态AI应用、搜索推荐等核心业务的内容安全与应用安全; 5、跟踪NeurIPS、ICML、ICLR、CVPR、ACL等顶会在大模型安全对齐、后训练、红队测试等方向的最新进展,持续迭代算法策略,保持技术领先。在团队中发挥技术领军作用,指导核心研发,推动跨团队协作与技术标准化。

任职要求

1、计算机、人工智能、数学等相关专业硕士及以上学历,5年以上算法研发经验。深入理解内容安全、风险建模或审核场景者优先; 2、深入理解大模型后训练全链路,具备SFT、RLHF等后训练与对齐算法的实际落地经验,有从数据处理、奖励模型训练到对齐策略调优的完整项目经验。熟悉CoT、模型蒸馏、参数高效微调(PEFT)等优化方法; 3、具备LLM或VLM的实际研发经验,深入理解训练数据处理、训练与对齐。精通Python,熟练使用PyTorch等深度学习框架及DeepSpeed、Megatron等分布式训练工具; 4、有大模型内容安全、风控、红队测试、对抗样本攻防等相关经验者优先。熟悉越狱攻击、提示词注入、有害输出等安全风险及其防御方法。有通过快速迭代模型或策略解决线上紧急安全问题的实际案例者优先; 5、在NeurIPS、ICML、ICLR、CVPR、ACL、AAAI等顶会/期刊发表过论文,或在Kaggle、ACM等权威竞赛中取得优异成绩者优先;或在业界大模型核心项目中担任核心研发角色者优先; 6、责任心强,抗压能力强,具备优秀的沟通协作与跨部门推动能力。能在高压环境下快速定位问题并输出方案,具备从研究到产品的端到端落地能力。

岗位标签

NEW

Apply now

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.