jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

集团安全部-AI高级安全工程师-大模型安全研究-杭州

Company 阿里巴巴

Focus 技术 · 安全

杭州

July 29, 2026

岗位职责

岗位职责:

  1. 防御机制测试: 对公司内大模型的安全围栏进行黑盒测试,通过实验分析其在内容过滤、逻辑保护方面的实现路径和问题,并输出分析报告。
  2. 安全围栏建设: 参与公司模型的内容审计系统开发,编写并维护核心的防御 Prompt 和过滤规则库。
  3. 风险路径探测: 对公司模型系统(含插件、沙箱)进行常规的安全评估,识别提示词泄露和接口滥用的潜在风险,并提出加固建议。
  4. 反蒸馏技术落地: 协助落地基础的防爬取、模型输出干扰等风控方案,保护公司模型资产。
  5. 跨团队协作: 与算法团队配合,将发现的安全漏洞转化为模型微调或对齐的训练样本。

任职要求

  1. 教育背景: 计算机、信息安全相关专业本科及以上学历, 对大模型底层原理(Transformer、RLHF等)有一定理解。
  2. 专业技能:
  1. 熟悉 Python/Go 至少一种,有扎实的编码功底,能自己写工具。
  2. 对 Prompt Engineering 有浓厚兴趣,是个“调教模型”的高手,能通过文字技巧引导模型突破限制。
  3. 具备基础的网络安全思维(如逻辑漏洞分析、接口测试),了解容器或 Linux 沙箱基本概念。
  1. 核心潜力: 具备极强的自主学习能力。大模型安全每天都在变,你需要能快速读懂英文技术论文或社区讨论(如 GitHub/Twitter/Reddit)。
  2. 工作心态: 具备“红队思维”。喜欢钻研“这个东西是怎么工作的”、“我怎么能让它不按常理出牌”,不迷信权威方案。
  3. 加分项(非必须): 有过 NLP 项目经验,或者在 Web 安全、移动安全领域有过一定深度的研究。

岗位标签

NEW

Apply now

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.