研究型实习生-大模型反对齐
Campus/Intern
Company Antgroup
Focus Tech · Algorithm
Location 北京, 上海, 杭州, 深圳
Published June 4, 2026
岗位职责
研究领域: 人工智能安全 项目简介: 随着大模型在各类核心业务场景的深度集成与应用,其强大的生成与理解能力在驱动价值创造的同时,也暴露于愈演愈烈的对抗性安全威胁之下。现有基于围栏的防护机制,难以有效抵御恶意用户精心设计的、不断进化的反对齐攻击手段(如越狱提示、模型窃取、后门植入等),无法保障模型在开放复杂环境中运行的稳定性和输出内容的合规性,亟需建立一套前瞻、主动且鲁棒的大模型反对齐防御体系。同时,反对齐的研究也有利于红军开发越狱技术、生成黑样本的能力,达成以防促攻、以攻促防的双飞轮
任职要求
研究领域: -目前正在攻读计算机科学或相关STEM领域的学士,硕士或博士学位 -具有一种或多种通用编程语言的经验,包括但不限于: Java,C/C ++ 、Python、JavaScript或Go -具有上述研究领域的相关经验,包括行业经验或作为参与实验室研究 优先录用: -对技术研究充满热情,具有产生新思想和创新的能力; 在自学,问题分析和解决方面表现出色 -在国际会议上或核心期刊发表一份或多份出版物或论文 -至少3个月的全职工作
特色标签
AI安全、C/C++、Golang、Java、Python、人工智能安全性、发表算法相关优秀论文、合规、后门攻击、大型语言模型、大模型反对齐、大模型算法、大语言模型、安全、提示越狱、数据安全、模型反对齐、模型后门、模型提取、模型越狱、模型逆向工程、深度学习、算法工程化经验、网络安全、自然语言处理算法