jdwatch
  • Home
  • CLI
  • Skills
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

阿里云智能-AI Data 工程师-MaaS数据-杭州

Inactive

Company Aliyun

Focus Tech · Backend

Location 杭州

Published August 18, 2026

岗位职责

  1. 全模态数据流水线与架构建设:参与万亿级、EB级海量多模态数据(涵盖多语言文本、图像、音频、视频及 Agent 行为数据等)的采集、存储、清洗与加工。设计并实现高效率、高质量的全模态流程编排引擎及核心处理算子(Pipeline),保障海量异构数据的规模化流转与高扩展性。

  2. 全模态数据自动化标注:能够结合深度学习与多模态大模型技术,研发并落地智能化的数据处理策略。利用算法模型进行跨模态特征提取与对齐、低质量噪声数据过滤、复杂场景下的异常数据拦截与高价值数据挖掘,大幅提升数据处理的自动化水平与数据质量。

  3. 多模态数据对齐、评估与合成:主导大规模“图-文”、“视-文”、“音-文”等多模态对齐数据的规模化生产,尤其是在稀缺数据领域,探索并落地智能标注与前沿的数据合成(Data Synthesis)技术。与算法团队紧密合作,深度参与多模态大模型SFT及对齐阶段的高质量数据集构建、配比调优与评测,并通过评测结果反向持续优化语料质量。

  4. 数据资产化与科学分析:主导AI应用的全流程数据仓库与数据分析研发工作,包括数据同步、数据建模、数据计算、数据挖掘分析与数据可视化;构建高扩展性、高一致性、高业务价值的AI应用核心数据资产体系,确保指标准确、及时与可追溯

  5. 关注数据处理领域的新技术、新工具和新方法,积极参与技术分享和团队内部培训,推动团队的技术升级和创新。

任职要求

  1. 熟练掌握java、python、sql中一种或多种数据处理语言等,具备良好的编程习惯与工程能力;熟悉 Linux/Unix 环境及常用 Shell 操作;
  2. 熟悉主流大数据平台(如 Hadoop、Spark、Flink、MaxCompute 等),有数据清洗、ETL开发、数据建模或数据仓库建设经验者优先;
  3. 具备机器学习与深度学习算法基础,有使用主流大语言模型及多模态模型处理数据的经验;
  4. 学历背景:本科及以上学历,计算机、数学、统计等相关专业优先。