jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

AI创新事业部-服务端研发-AI 模型&架构方向

Company 阿里巴巴

Focus 技术 · 后端

杭州

July 29, 2026

岗位职责

  1. 大模型推理与调度平台建设:主导多模态/LLM 推理服务化与模型调度中台(自研/二方/三方)建设,支持同模型多账号、多模型共存、降级容错与弹性扩缩容,保障高并发低时延的线上推理体验。
  2. 推理加速与资源效率优化:推进推理加速与 GPU 资源复用等优化策略落地,提升模型利用率并降低单位推理成本。
  3. 模型成本治理体系:建设模型资源(如配额、用量、费用、使用期限/到期策略)可视化与治理闭环,推动降本动作落地并形成可持续的成本优化机制。
  4. 服务端基础架构演进与全球化支撑:负责全球多 Region 架构规划与服务端架构演进,建设统一网关与用户服务体系,支撑业务快速迭代与流量调度、容错容灾与性能优化。
  5. SRE 稳定性与可观测性建设:构建全链路监控与自动化运维能力,完善异常响应、容量管理与弹性扩容机制,提升平台可用性与可运营性。
  6. 架构融合与平台化治理:推动团队多款 AI 产品服务端架构融合与服务复用,减少重复投入并沉淀统一能力,持续演进与维护以满足企业级/ToC 产品化交付要求。

任职要求

  1. 本科及以上学历,计算机科学、软件工程或相关专业;具备大模型服务平台/推理系统/分布式系统工程化经验者优先。
  2. 编程能力:精通 Go/Java 至少一门语言。
  3. 深度掌握服务化架构设计(如模型调度中台、API网关),主导过复杂分布式系统架构设计与落地;熟悉资源弹性调度算法、成本优化策略(如GPU资源复用)及容灾方案设计。
  4. 熟悉多Region架构设计,掌握服务网格、全链路监控、混沌工程实践; 具备容量规划、故障自愈系统开发经验,熟悉K8S集群部署与优化。
  5. 熟悉AIOps技术栈(如自动化评测、DevOps闭环),有AI Agent框架开发经验者优先;在高并发场景下主导过架构优化,或实现过千万级用户服务端系统者优先。

岗位标签

NEW

Apply now

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.