高德-语音多模态算法工程师-语音理解方向
Company Amap
Focus Tech · Algorithm
Location 北京
Published August 4, 2026
岗位职责
-团队介绍 高德语音技术部是负责高德全栈语音技术的综合性团队,致力于通过前沿语音技术的研究与落地,赋能下一代 AI 产品创新。 团队核心技术能力覆盖:自研 ASR&TTS 基座大模型、端侧模型、多语种、RTC 流式语音、语音内容生成、语音识别、跨模态模型、模型服务与推理等方向。业务支撑面向高德全部核心场景,包括语音导航、AI 领航员、IP 语音定制、国际化、AI 语音助手、智能外呼、内容生成等。 我们相信技术创造价值。近期部分产品进展:高德AI伴行 https://mp.weixin.qq.com/s/SDlTjmNSi-PAptxuPx3UHw 岗位描述:
- 负责语音唤醒、增强、识别、语音与大模型融合等核心语音模块研发,独立开展技术研究与业务落地;
- 结合高德地图导航、语音交互等真实业务场景,持续提升复杂场景下的语音理解与生成能力;
- 持续跟踪业界前沿语音大模型技术,结合业务需求开展语音多模态、全双工交互等技术创新与预研。
- 与产品、工程架构团队紧密协作,完成技术方案的部署上线与性能优化,实现从技术到价值的闭环。
任职要求
任职要求:
- 计算机、人工智能、信息、自动化等相关专业硕士及以上学历,具备语音、自然语言处理、机器学习、多模态等背景;
- 熟练掌握至少一种主流深度学习框架(PyTorch / TensorFlow),具备扎实的模型开发与训练实战经验;
- 熟练掌握 C/C++、Python、Shell 等编程语言,对数据结构与算法设计有深入理解;
- 具备良好的沟通能力、团队协作精神与自我驱动力,对技术充满热情。 加分项: ● 在国际顶级会议或期刊(ICASSP、Interspeech、ICML、NeurIPS 、ICLR等)发表过论文; ● 在 ACM/ICPC、NOI/IOI、TopCoder、Kaggle 等竞赛中获奖; ● 具备端侧语音模型部署、大模型微调或多模态融合的项目经验。
岗位标签
NEW