jdwatch
  • Home
  • CLI
  • Skills
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

大模型算法工程师(AI Infra 高阶)

Company Jd

Focus Tech · Algorithm

Location 上海

Published August 23, 2026

岗位职责

我们的核心使命 (Core Mission):我们专注于大语言模型(LLM)的全栈技术突破与前沿探索,拒绝平庸的复刻,追求极致的创新:

大模型基座研发:从 Pre-training 到 Post-training,探索千亿/万亿参数模型的高效训练与极致性能,挑战 Scaling Law 的边界。 复杂推理与对齐:攻克 CoT(思维链)、RLHF/RLAIF 等核心难题,打造具备深层逻辑推理能力与价值观对齐的通用智能。 Agent 与多模态融合:赋予模型“手”和“眼”,构建能够操作工具、理解世界的自主智能体(Autonomous Agents)。 产业级落地验证:Research for Impact。你的算法将直接部署于京东万亿级的零售、物流、金融场景中,服务数亿用户,实现技术价值的闭环。

顶尖的精英团队 (Elite Team):在这里,你将与业内最聪明的大脑并肩作战。我们的成员背景极具“密度”,团队聚集大量国内外顶尖高校的大模型原生的年轻人才,在各个方向都有领域内知名技术专家引领。团队在 Nature, TPAMI, NeurIPS, ACL, CVPR, ICML, ICLR, KDD等顶刊顶会议上累计发表论文数百篇,在各类国际AI竞赛中屡获桂冠。团队拥有浓厚的各种技术氛围,没有层级森严的壁垒,推崇“黑客精神”与工程师文化,扁平化管理,让想法在咖啡与代码中自由碰撞。

硬核的工作环境与支持 (Why Us):要造出世界级的模型,必须有世界级的“军火库”。我们拥有顶级规模的 GPU 算力集群(万卡级别),绝不让算力成为你验证 Idea 的瓶颈,享有京东生态内数千亿 token 的高质量专有数据,这是公开数据集无法比拟的。

  1. 参与大模型训练与推理基础架构的优化设计,改进万卡集群环境下的分布式训练与推理性能,推动相关框架落地;
  2. 负责设计并参与大模型与视觉语言模型的完整训练流程,涵盖预训练、中训练与后训练,保障模型能力持续提升;
  3. 构建高质量训练数据的生产与评估体系,制定数据筛选、配比优化与自动化质检机制,驱动模型效果正向发展;
  4. 研究并应用强化学习技术,包括奖励模型、OPD与异步强化学习,提升模型推理稳定性、指令遵循与安全性;
  5. 总结技术实践形成可复用的方法论,参与技术报告撰写与开源项目输出,提升团队在AI基础设施领域的专业影响力。

任职要求

  1. 具备大规模语言模型与视觉语言模型全流程训练经验,能设计并参与预训练、中训练及后训练阶段,保障模型能力持续提升;
  2. 拥有万卡级别集群下AI基础设施实践经验,熟悉从数据到训练再到推理的完整链路,能基于Megatron、vLLM等框架优化分布式训练与推理性能;
  3. 能够定位大规模训练故障或性能瓶颈的底层成因,制定有效对策,并具备结合前沿论文与工程实践在数据筛选、强化学习对齐或算子优化等方面提出创新性解决方案的能力;
  4. 致力于在大模型基础架构领域追求技术领先,长期投入于AI基础设施的突破,并在高强度技术攻坚中坚持高标准,主动承担难点任务,追求持续技术突破;
  5. 符合京东价值观:客户为先、创新、拼搏、担当、感恩、诚信。

部门

探索研究院