jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

AI推理平台-AI 高性能计算工程师-杭州/北京

Company Alibaba

Focus Tech · Backend

Location 北京, 杭州

Published August 3, 2026

岗位职责

我们是阿里巴巴大模型推理团队,负责生成式AI领域(主要是图像生成和LLM)的内部产品、训练推理服务系统建设和维护,为淘宝、天猫、聚划算、优酷、闲鱼等多个集团业务部门提供强有力的技术支撑和底层服务能力。

  1. 针对特定异构芯片(如华为昇腾、AMD MI系列等),深入分析其指令集、存储层级(HBM/Cache)和计算单元特性,使用原生语言(如CANN C/C++, HIP C++)手写和优化核心算子(如Attention, MoE Gate, GEMM等),实现极致性能。
  2. 主导或核心参与基于编译技术的算子优化方案,利用Triton、TileLang、JAX/MLIR等技术栈,构建一套可跨硬件复用的算子生成与图优化框架,大幅缩短新卡型或新模型的适配周期。
  3. 使用专业的Profiling工具,对模型在异构硬件上的端到端性能进行分析,精准定位Kernel执行、数据搬运、通信等环节的瓶颈,并提出体系化的优化方案。 4、工作地点:北京、杭州,未来会开放「上海」工作地点,现阶段支持员工根据团队安排部分时间在上海办公,详情可与hr或面试官沟通。

任职要求

  1. 计算机、电子工程或相关专业本科及以上学历,对计算机体系结构有深刻理解。
  2. 拥有深厚的GPU/NPU/XPU高性能计算优化经验,精通至少一种异构计算平台及编程模型(如CUDA, ROCm, OpenCL, SYCL, CANN等)。
  3. 熟悉现代AI模型(特别是Transformer架构)中关键算子的计算原理和优化方法。

具备以下至少一项经验者优先:

  1. 有从零手写高性能算子(Kernel)并取得显著性能收益的成功案例。
  2. 熟悉编译器技术,有MLIR/LLVM相关开发经验,或有丰富的Triton/TVM算子开发与优化经验。
  3. 有针对AMD、华为、Intel等特定AI芯片的深度性能调优经验。
  4. 具备极强的技术钻研精神和解决复杂问题的能力,能够适应快速迭代的技术环境。

岗位标签

NEW

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.