研究型实习生-大模型反对齐

Intern

Company Antgroup

Focus Tech · Algorithm

Location 北京, 上海, 杭州, 深圳

Published June 4, 2026

岗位职责

研究领域: 人工智能安全 项目简介: 随着大模型在各类核心业务场景的深度集成与应用,其强大的生成与理解能力在驱动价值创造的同时,也暴露于愈演愈烈的对抗性安全威胁之下。现有基于围栏的防护机制,难以有效抵御恶意用户精心设计的、不断进化的反对齐攻击手段(如越狱提示、模型窃取、后门植入等),无法保障模型在开放复杂环境中运行的稳定性和输出内容的合规性,亟需建立一套前瞻、主动且鲁棒的大模型反对齐防御体系。同时,反对齐的研究也有利于红军开发越狱技术、生成黑样本的能力,达成以防促攻、以攻促防的双飞轮

任职要求

研究领域:

  • 目前正在攻读计算机科学或相关STEM领域的学士,硕士或博士学位
  • 具有一种或多种通用编程语言的经验,包括但不限于: Java,C/C ++ 、Python、JavaScript或Go
  • 具有上述研究领域的相关经验,包括行业经验或作为参与实验室研究 优先录用:
  • 对技术研究充满热情,具有产生新思想和创新的能力; 在自学,问题分析和解决方面表现出色
  • 在国际会议上或核心期刊发表一份或多份出版物或论文
  • 至少3个月的全职工作

特色标签

AI安全、C/C++、Golang、Java、Python、人工智能安全性、发表算法相关优秀论文、合规、后门攻击、大型语言模型、大模型反对齐、大模型算法、大语言模型、安全、提示越狱、数据安全、模型反对齐、模型后门、模型提取、模型越狱、模型逆向工程、深度学习、算法工程化经验、网络安全、自然语言处理算法