jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

蚂蚁集团-AI Feedback Loop 专家-杭州/上海

Company Antgroup

Focus Tech · Algorithm

Location 上海, 杭州

Published July 31, 2026

岗位职责

  1. 建设高实时性的用户反馈数据流: 负责构建大规模,高并发的实时数据链路,处理海量用户交互日志。 负责对多模态的用户反馈信号进行全链路的清洗,归因与结构化处理,为模型迭代提供标准化的数据养料。
  2. 打造自动化的大模型演进闭环 建设面向RLHF和DPO的数据工程体系,自动化构建高质量的偏好数据集,并制成模型的持续对齐与优化。 设计Bad Case自动发现与诊断机制,通过数据驱动的方式识别模型与知识短板,协同算法与知识工程团队形成质量提升的闭环,持续降低模型幻觉率。
  3. 质量归因: 解决多轮交互场景下的归因难题:通过因果推断等技术手段,精准定位用户体验波动的核心因子,知道算法迭代方向。

任职要求

1.架构设计: 5年以上经验。具备Data-Centric AI 的系统设计能力。能独立设计从用户行为到模型更新的端到端自动化链路。 2.AI 理解力: 需要深刻理解 RLHF, Reward Model, SFT 的原理。深刻理解样本的质量。 3.复杂归因: 在归因分析(Attribution Analysis)和因果推断(Causal Inference)有深入实践,能解决数据噪音和反馈稀疏的问题。 4.业务影响力: 能与算法、业务深度对话,反向推动数据采集标准的制定。 加分项 有 RLHF 数据工程 或 Active Learning (主动学习) 平台建设经验者优先。 有 知识图谱 (Knowledge Graph) 自动化构建或众包清洗平台经验者优先。 有大规模 在线学习 (Online Learning) 系统工程经验者优先。 对构建 Agent Memory 或 长期记忆系统 有强烈兴趣和独到见解。

岗位标签

NEW

特色标签

ETL设计/开发经验、Flink、Hive、Kafka、Python、Redis、Scala、Shell、Spark、SQL、人类反馈强化学习、偏好优化、分布式系统开发经验、回报模型、因果分析、因果推理、在线机器学习、基于人类反馈的强化学习、多模态信号、多模态反馈、多模态算法、大数据处理工具(Spark/Hadoop/Hive)、大数据处理经验、大数据开发经验、大数据经验、大模型算法、奖励模型、实时学习、强化学习、归因、归因分析技术、数学/统计相关专业、数据净化、数据分析/挖掘经验、数据处理经验、数据挖掘、数据清洗处理、智能交互、智能体、智能研发、有监督微调、机器学习、机器学习建模经验、架构设计经验、熟悉Linux环境、监督微调、直接偏好优化、知识图谱、知识图谱平台、知识图谱构建、算法工程化经验、自然语言处理算法、自然语言处理经验、计算机相关专业

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.