岗位职责
团队介绍:
我们是京东云事业部AI Infra团队,致力于前沿的大模型技术创新与应用。我们专注于研发业界领先的大模型算法,构建极致高效的大模型训练与推理平台,提供高吞吐高可用、低成本低延迟的大模型服务。我们的核心使命是高效支持和驱动京东集团内外部的大模型业务生态及智能体应用,涵盖业界主流开源模型和京东自研模型的训练与推理服务。我们团队秉承技术驱动、创新为本的理念,为每一位成员提供广阔的成长空间和富有挑战性的项目。
- 开发GPU与国产NPU大模型核心算子,解决训练精度与性能瓶颈;
- 深度优化AI编译器中间表示层,制定算子融合与指令调度策略以提升异构芯片部署效率;
- 构建低比特量化与系统级优化方案,推动W4A8等前沿技术在推理落地,实现计算通信高效重叠;
- 针对大模型业务痛点,定义底层算法优化问题并提出创新性系统解决方案以提升技术指标;
- 形成AI Infra技术方法论,输出可复用的优化框架与实践标准以支撑中长期技术突破。
任职要求
- 具备高性能算子开发能力,能针对GPU与国产NPU架构设计并实现大模型核心算子,解决性能与精度瓶颈;
- 拥有AI编译器优化经验,能够深度优化TVM或MLIR中间表示层,制定算子融合与指令调度策略以提升异构芯片部署效率;
- 具备系统瓶颈分析能力,能够从大模型训练与推理性能数据中识别底层架构缺陷并提出系统性优化路径;
- 能够追踪低比特量化与计算通信重叠等前沿技术,设计创新性系统级优化方案并推动落地;
- 致力于在AI Infra领域实现技术领先,长期投入构建高效、低成本的大模型基础设施;
- 符合京东价值观:客户为先、创新、拼搏、担当、感恩、诚信。
部门
京东科技