生态发展部-资深游戏测试工程师-Agent评测

Company Tencent

Focus Tech · Testing

Location 深圳

Published July 24, 2026

岗位职责

  1. 负责AI Agent全链路评测与质量保障工作,聚焦Agent能力基准测试、自动化评测基座建设及分级评测指标定义;
  2. 针对AI生成的非确定性与参数化特点,设计并量化评测标准,搭建科学的分级评测指标体系;
  3. 主导构建高质量的基准测试集(Benchmark),覆盖多轮交互、长短上下文等复杂场景,解决AI生成结果验证标准量化的核心难题;
  4. 参与设计和研发Agent自动化评测基座,通过构建自动化测试脚本和引入大模型交叉验证(LLM-as-a-Judge)机制,提升评测效率;
  5. 建立高效的缺陷定界机制,精准判断问题根因,输出多维度评测报告并协同开发团队推动问题解决。

任职要求

  1. 本科及以上学历,计算机、软件工程、人工智能等相关专业,3年及以上测试开发/评测经验,具备大模型或AI Agent核心评测经验;
  2. 深入理解大模型及AI Agent核心运行逻辑,能快速拆解Agent驱动游戏生成的业务链路;
  3. 具备优秀的逻辑思维与缺陷定界能力,能基于生成日志、链路追踪工具快速定位复杂AI生成异常的根因;
  4. 具备优秀的跨团队沟通协作能力和执行力,能高效对接算法、研发、产品团队,推动测试工作落地和问题闭环;
  5. 精通至少一门编程语言,具备扎实的编码基础。

产品/项目

轻游AI Agent

工作年限

三年以上工作经验