Company Didi
Focus Tech · Algorithm
Location 北京
Published May 6, 2026
负责语音理解和语音生成算法在滴滴场景的落地使用
跟进最新技术,结合业务场景,提升语音识别、音频事件检测、声纹识别、语音合成等算法效果
探索语音大模型或多模态大模型在语音理解及语音生成场景的应用范式
算法优化,从模型架构、推理框架、量化压缩等角度提升模型推理速度、降低推理成本
电子、计算机或相关声学、信号处理专业毕业,具备一定语音信号处理基础
熟悉Pytorch框架,良好的编程能力,熟练使用python编程语言,具备Linux平台开发经验
有语音识别、音频事件检测、声纹识别、语音合成算法等经验优先
在ICASSP、Interspeech、ASRU等语音顶会或国际竞赛有论文发表或优异成绩优先
ACM竞赛取得优异成绩或有优秀C++编程能力优先
AIoT产品事业部