资深语音算法工程师 (JR2026032600R)

Company Didi

Focus Tech · Algorithm

Location 北京

Published May 6, 2026

岗位职责

  1. 负责语音理解和语音生成算法在滴滴场景的落地使用;
  2. 跟进最新技术,结合业务场景,提升语音识别、音频事件检测、声纹识别、语音合成等算法效果;
  3. 探索语音大模型或多模态大模型在语音理解及语音生成场景的应用范式。

任职要求

  1. 电子、计算机或相关声学、信号处理专业毕业,具备一定语音信号处理基础;
  2. 熟悉Pytorch框架,良好的编程能力,熟练使用python编程语言,具备Linux平台开发经验;
  3. 3-5年语音识别、音频事件检测、声纹识别、语音合成等算法经验;
  4. 在ICASSP、Interspeech、ASRU等语音顶会或国际竞赛有论文发表或优异成绩优先;
  5. ACM竞赛取得优异成绩或有优秀C++编程能力优先;
  6. 有大型语音识别、语音合成项目经验者优先。

部门

AIoT产品事业部