jdwatch
  • Home
  • CLI
  • Skills
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

蚂蚁集团-大模型算法评测-蚂蚁星河

Company Antgroup

Focus Tech · Testing

Location 杭州

Published August 27, 2026

岗位职责

  1. 按照产品架构和业务要求,设计覆盖功能及非功能需求,AI大模型应用、智能引擎、算法服务的产品质量保障。
  2. 测试能力建设:解决测试复杂技术问题,开发适配大模型及算法服务的测试工具与平台。
  3. 研究测试新技术方法,推进AI算法评测、AI原生应用测试能力升级;攻克算法领域特有质量难题(精度验证、AB实验评估、幻觉检测等)。
  4. 结合AI行业发展趋势,制定技术团队的合适的质量发展规划,与算法、工程、产品团队紧密协作,深入理解AI模型能力和边界;推动质量技术左移及需求迭代全栈。

任职要求

  1. 三年以上互联网或传统行业开发测试及质量保障经验;一年以上AI大模型/算法类产品测试经验(大模型/推荐/搜索/NLP系统等)优先。
  2. 对软件质量保障有体系化思考和实践经验,能应对复杂系统的质量挑战。熟悉大模型应用测试场景:精通至少一个测试领域(自动化测试/性能测试/安全测试);熟悉主流AI技术栈,熟练使用Python/Java/go/sql等编程语言.有测试工具平台开发经验,具备工程化能力。
  3. 具备算法评测基础知识,熟悉评测指标,了解badcase分析及评测数据集构建方法,了解模型应用skill,agent,MCP,prompt,loop等技术体系,能设计针对特定场景下大模型应用的合适的工程能力。
  4. 对新事物有强烈求知欲、有创新精神,乐于和热于技术钻研。

岗位标签

NEW

特色标签

AB测试评估、Golang、Go测试开发、Java、Java测试开发、JMeter、MySQL、Postman、Python、Python测试开发、SDK测试经验、Selenium、SQL数据验证、Web测试经验、云计算、信贷、功能测试、合规、大模型产品化、大模型幻觉监控、大模型落地应用、安全、安全评估、安全验证、实验效果验证、幻觉识别、广告、性能保障、性能测试、性能验证、推荐、支付、数据安全、智能体、模型评估、测试工具、测试工具链、测试平台开发、算法引擎、算法效果评估、算法系统、精度验证、自动化测试、自动化测试框架、自动化测试经验、自动化测试能力、金融、风控