模型推理优化工程师 (JR2026070700E)
Company Didi
Focus Tech · Backend
Location 北京
Published July 7, 2026
岗位职责
参与车载端AI模型的优化、部署与调度,保障车端系统高效、稳定运行; 深入参与车端系统稳定性建设,对系统级风险与问题具备独立排查与根因分析能力,高效解决复杂疑难问题; 支持大模型在仿真、标注等环境中的服务化部署与验证,助力业务模型快速迭代; 跟踪业界前沿技术动态,持续探索并引入先进的性能优化方法与工具链;
任职要求
掌握Python/C++编程语言, 熟悉至少一种主流推理引擎(如 TensorRT、OnnxRuntime 等),并熟练使用至少一种大模型推理部署框架(如 vLLM、SGLang、TensorRT-LLM 等); 熟悉GPU架构(如NVIDIA Hopper、ThorX),有CUDA/OpenMP编程经验者优先,熟悉CUDA 编程工具的使用; 具备优秀的沟通协作能力和扎实的问题分析与解决能力; 加分项: 熟悉PyTorch等深度学习训练框架; 有大模型(LLaMA、Qwen、GPT等)服务化部署经验者优先。 熟悉vLLM、TGI、LightLLM、SGLang等大模型专用推理框架者优先。 熟悉 NVIDIA Thor 芯片架构,具备在其上进行模型部署、推理加速与资源调度优化的实际经验者优先;
部门
Voyager