岗位职责
团队介绍:我们是京东云事业部AI Infra团队,致力于前沿的大模型技术创新与应用。我们专注于研发业界领先的大模型算法,构建极致高效的大模型训练与推理平台,提供高吞吐高可用、低成本低延迟的大模型服务。我们的核心使命是高效支持和驱动京东集团内外部的大模型业务生态及智能体应用,涵盖业界主流开源模型和京东自研模型的训练与推理服务。我们团队秉承技术驱动、创新为本的理念,为每一位成员提供广阔的成长空间和富有挑战性的项目。
- 研发大模型高性能算子与通信算子,定位并解决精度与性能瓶颈;
- 深度优化AI编译器中间表示层,设计算子融合与调度策略以支撑大模型高效部署;
- 构建低比特量化与端云协同方案,落地W4A8/FP8等技术以降低推理成本与延迟;
- 主导算法方向长期规划,形成可复用的优化方法论以支撑技术创新;
- 建立算法效果与系统性能评估机制,量化技术方案对业务指标的贡献。
任职要求
- 具备高性能算子开发能力,能在GPU及国产NPU上实现与优化FA、MLA、MoE等核心算子,定位性能瓶颈;
- 精通AI编译器优化,基于TVM或MLIR进行深度优化,设计算子融合与指令调度策略以提升模型部署效率;
- 拥有低比特量化技术经验,能落地W4A
- FP8等量化方案,并设计端云协同的推理加速系统以降低延迟与成本;
- 具备系统性瓶颈分析能力,能从复杂性能现象中定位底层架构问题,提出可验证的优化方案;
- 有技术路径创新意识,能针对国产芯片适配与编译器优化等高不确定性方向进行前瞻性判断与推动;
- 符合京东价值观:客户为先、创新、拼搏、担当、感恩、诚信。
部门
京东科技