AI推理平台-AI 高性能计算工程师-杭州/北京
Company Alibaba
Focus Tech · Backend
Location 北京, 杭州
Published August 3, 2026
岗位职责
我们是阿里巴巴大模型推理团队,负责生成式AI领域(主要是图像生成和LLM)的内部产品、训练推理服务系统建设和维护,为淘宝、天猫、聚划算、优酷、闲鱼等多个集团业务部门提供强有力的技术支撑和底层服务能力。
- 针对特定异构芯片(如华为昇腾、AMD MI系列等),深入分析其指令集、存储层级(HBM/Cache)和计算单元特性,使用原生语言(如CANN C/C++, HIP C++)手写和优化核心算子(如Attention, MoE Gate, GEMM等),实现极致性能。
- 主导或核心参与基于编译技术的算子优化方案,利用Triton、TileLang、JAX/MLIR等技术栈,构建一套可跨硬件复用的算子生成与图优化框架,大幅缩短新卡型或新模型的适配周期。
- 使用专业的Profiling工具,对模型在异构硬件上的端到端性能进行分析,精准定位Kernel执行、数据搬运、通信等环节的瓶颈,并提出体系化的优化方案。 4、工作地点:北京、杭州,未来会开放「上海」工作地点,现阶段支持员工根据团队安排部分时间在上海办公,详情可与hr或面试官沟通。
任职要求
- 计算机、电子工程或相关专业本科及以上学历,对计算机体系结构有深刻理解。
- 拥有深厚的GPU/NPU/XPU高性能计算优化经验,精通至少一种异构计算平台及编程模型(如CUDA, ROCm, OpenCL, SYCL, CANN等)。
- 熟悉现代AI模型(特别是Transformer架构)中关键算子的计算原理和优化方法。
具备以下至少一项经验者优先:
- 有从零手写高性能算子(Kernel)并取得显著性能收益的成功案例。
- 熟悉编译器技术,有MLIR/LLVM相关开发经验,或有丰富的Triton/TVM算子开发与优化经验。
- 有针对AMD、华为、Intel等特定AI芯片的深度性能调优经验。
- 具备极强的技术钻研精神和解决复杂问题的能力,能够适应快速迭代的技术环境。
岗位标签
NEW