jdwatch
  • Home
  • CLI
  • Skills
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

千问事业部-高级AI应用研发工程师-长任务Agent质量

Company Quark

Focus Tech · Backend

Location 北京

Published August 26, 2026

岗位职责

  1. 负责任务助理业务(云端/本地agent支持长程复杂任务)的业务质量保障,参与产品需求与技术架构评审,评估 AI 方案的架构合理性、可测性与可评测性,在方案阶段就把成功标准和验收口径定义清楚;
  2. 构建面向生成式内容的 AI 原生质量体系:设计并落地评测能力(标准定义、Golden Set、LLM-as-Judge、人工校准),把高度主观的效果判断转化为可复现、可回归、可卡点的自动化门禁,覆盖生成效果、性能、稳定性与内容安全;
  3. 用 Agent 重做质量工作:以尽可能高的托管比例为目标,通过 Agent / Skill / 工具链的方式重构需求分析、用例生成、自动化执行、失败归因、缺陷闭环等环节,完成任务编排与交付,产出团队可复用的能力沉淀;
  4. 通过全链路 trace、线上监控与指标体系,保障多端(App三端 / PC客户端 / H5 / PC web)生成链路的服务稳定性与用户体验,具备从用户反馈反查到链路日志、模型调用与下游服务的定位归因能力,驱动体验水位持续提升;
  5. 通过全链路数据分析、效果评测与竞对对比,帮助业务识别目标达成路径上的核心问题并驱动解决,同时量化质量投入的产出与 ROI,让质量成为业务决策的输入而非交付末端的检查站。

任职要求

  1. 3 年以上研发或质量工程经验,计算机理论基础扎实,至少精通一门编程语言(Python / Java / TypeScript 优先),能独立完成工具、服务与自动化系统的设计与交付,而不止于脚本编写;
  2. 对 AI Agent 具备真实的工程认知而非概念了解:理解工具调用、上下文管理、多 Agent 编排、Eval 的作用与能力边界,有用大模型 / Agent 解决实际业务问题并真实落地的案例,AI 工具是日常工作方式而不是偶尔点缀;
  3. 熟悉互联网产品的设计开发流程,具备用户型产品的功能、性能、稳定性测试经验,以及线上稳定性与体验水位监控、问题分析能力;有生成式内容(文档类/小程序/网页/图片/ 文本)效果评测、多模态测试、长生成链路(多端/复杂入参/意图/模型推理)质量经验者优先;
  4. 有数据驱动意识,能把质量目标拆成口径清晰、可被追问的指标(如有效缺陷、线上漏出率、首包耗时、效果通过率、Skill 采纳率),用数据辅助质量决策、体验提升与业务目标达成;
  5. 良好的沟通协作能力与强 owner ship,能在需求模糊、无先例的场景下主动定义问题、推动跨团队对齐;愿意把个人实践抽象成可被他人复用的方法论或工具并在团队内外分享。

加分项:

  1. 主导过某业务域从 0 到 1 的 AI 原生方案设计与落地,方案被跨团队采用或复用;
  2. 有组织级评测体系、质量平台或工具链建设经验,能抽象出统一接口与标准;
  3. 指标驱动,能评估 AI 方案与传统方案的成本效益,在多条技术路径中给出有依据的选择,并对结果负责。