模型评估算法工程师 (JR2026080400T)
Company Didi
Focus Tech · Algorithm
Location 北京
Published August 5, 2026
岗位职责
开环评估体系:
- 设计WLA端到端模型的评估指标,包括决策合理性,驾驶安全性,舒适性和效率等指标;
- 搭建自动化评测管线,支持模型迭代的快速回归验证 评测数据建设:
- 从海量路采数据中筛选高价值长尾场景(特种车辆、非标障碍物、临时交通管制、施工绕行等),构建分级评测数据集,量化场景覆盖度
- 利用VLM/WLA模型自动化生成场景语义标签和行为标注,驾驶行为评估等,建立校验机制保障标注质量 归因分析:
- 对模型失败case进行多维度归因:视觉感知错误?语义推理偏差?动作生成问题?建立从case到模块的逆向诊断链路
- 定期输出模型能力画像和缺陷分布,为模型迭代和数据策略提供量化依据 前沿探索:
- 跟踪行业WLA/世界模型评估前沿,将其落地到闭环仿真迭代
任职要求
必备条件: 2年以上自动驾驶规划或模型评估经验,熟悉端到端自动驾驶技术架构 精通Python和C++,具备扎实的数据处理和统计分析经验 能从case出发逆向定位模型问题,对"模型为什么会犯错"有强烈好奇心 优先条件: 深度参与过千万clips级别的端到端/WLA模型训练或评测项目 熟悉多模态大模型架构和视频生成模型,及其在自动驾驶中的应用 在CVPR/ICCV/ECCV/NeurIPS/CoRL等发表过相关论文者优先
部门
Voyager