集团安全部-AI高级安全工程师/专家-杭州Company AlibabaFocus Tech · SecurityLocation 杭州Published August 25, 2026岗位职责 防御机制拆解: 跟踪国内外主流模型的安全策略,通过实验分析其在内容过滤、逻辑保护方面的实现路径,并输出分析报告。 安全围栏建设: 参与公司模型的内容审计系统开发,编写并维护核心的防御 Prompt 和过滤规则库。 风险路径探测: 对模型系统(含插件、沙箱)进行常规的安全评估,识别提示词泄露和接口滥用的潜在风险,并提出加固建议。 反蒸馏技术落地: 协助落地基础的防爬取、模型输出干扰等风控方案,保护公司模型资产。 跨团队协作: 与算法团队配合,将发现的安全漏洞转化为模型微调(SFT)或对齐(RLHF)的训练样本。 任职要求 教育背景: 计算机、信息安全相关专业本科及以上学历, 对大模型底层原理(Transformer、RLHF等)有一定理解。 专业技能: 熟悉 Python/Go 至少一种,有扎实的编码功底,能自己写工具。 对 Prompt Engineering 有浓厚兴趣,是个“调教模型”的高手,能通过文字技巧引导模型突破限制。 具备基础的网络安全思维(如逻辑漏洞分析、接口测试),了解容器或 Linux 沙箱基本概念。 核心潜力: 具备极强的自主学习能力。大模型安全每天都在变,你需要能快速读懂英文技术论文或社区讨论(如 GitHub/Twitter/Reddit)。 工作心态: 具备“红队思维”。喜欢钻研“这个东西是怎么工作的”、“我怎么能让它不按常理出牌”,不迷信权威方案。 加分项(非必须): 有过 NLP 项目经验,或者在传统的 Web 安全、移动安全领域有过一定深度的研究。