jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

蚂蚁集团-网络爬虫技术专家-【垂类大模型】

Company Antgroup

Focus Tech · Algorithm

Location 杭州

Published July 31, 2026

岗位职责

  1. 负责全网高价值互联网数据源发现,涵盖网页、PDF、音视频等多模态来源,分析评估数据天花板,支持金融等核心领域数据全面覆盖;
  2. 负责全网数据采集相关系统架构设计和开发工作,持续优化提升数据任务和系统能力水位,充分支持模型训练、RAG搜索等数据需求;
  3. 持续提升技术竞争力,在数据覆盖、数据时效、下载渲染成功率、采集成本方面做到行业领先水位;
  4. 保障系统稳定性,预判并解决系统潜在技术风险,持续降低技术负债。

任职要求

  1. 精通数据采集/网络爬虫领域,具备解决全网爬虫核心问题实战经验,3年以上大型互联网公司开发经验;
  2. 熟练掌握Java/Python/Go当中至少一种编程语言,具备主导复杂系统架构设计能力;
  3. 熟悉分布式架构和并发编程,熟悉业界主流大数据计算存储引擎Spark/Flink/MaxCompute等,具有数据密集型应用开发经验;
  4. 有运用LLM能力解决生产问题案例可加分,熟悉网络协议及代理、浏览器引擎和移动端技术可加分。

岗位标签

NEW

特色标签

Apache Flink、Apache Spark、Golang、Java、Python、RAG、Spark、分布式系统、分布式经验、分布式计算、多模态数据、多源异构数据、大数据经验、大模型、大语言模型、数据抽取、数据拉取、数据获取、架构设计经验、检索增强生成、爬虫技术、网络数据采集、网页抓取、金融、阿里云MaxCompute、音视频经验

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.