语音算法高级专家 (JR20260727001)
Company Didi
Focus Tech · Algorithm
Location 北京
Published July 28, 2026
岗位职责
1、负责滴滴全场景语音算法体系(ASR/TTS/KWS/VPR/降噪/SER)的规划、建设与落地,覆盖语音交互、智能客服、出行安全三大核心业务场景。 2、主导端云协同的语音算法架构设计与技术中台建设,推动Speech LLM等前沿技术在业务中的落地应用。 3、负责语音算法团队的搭建、培养与管理,保障算法从研发到上线的全链路高效运转与高质量交付。
任职要求
1、硕士及以上学历优先,计算机、电子信息、通信工程、信号处理、自动化等相关专业。 2、8年以上语音算法研发经验,有大规模语音系统落地经验;3年以上10人以上团队管理经验。 3、在ASR、TTS、语音增强与降噪、KWS、VPR、SER等方向中,具备3个以上的深度实战经验,全栈均衡型优先。 4、精通PyTorch/TensorFlow及Kaldi/Espnet/HuggingFace等语音工具链,熟悉模型压缩、量化等端侧部署优化技术,具备扎实的Python/C++工程能力。 5、熟悉大规模分布式训练与推理框架,有GPU集群使用经验,有Speech LLM微调与应用经验者优先。 6、具备优秀的技术判断力、架构设计能力和跨团队协作能力,能制定中长期技术规划并推动执行。 7、有车载语音交互或智能客服领域产品经验者优先;有从0到1搭建团队经验者优先。 8、在ICASSP、Interspeech等语音领域顶级会议有论文发表或开源项目重要贡献者优先。
部门
AIoT产品事业部