千问事业部-音频多模态理解算法专家-杭州/北京/上海
Company Quark
Focus Tech · Algorithm
Location 北京, 杭州, 上海
Published July 2, 2026
岗位职责
- 负责音频多模态理解大模型的研发,包含语音识别、语音翻译、副语言理解、音频事件检测或音频captioning等任务的基础研究和应用落地;
- 研究音频编码器、跨模态对齐、强化学习、多任务学习或语音端到端等技术方向;
- 跟踪并落地领域内前沿论文,保持技术方案的领先性。
任职要求
- 计算机、信号处理、数学等相关专业硕士/博士学位,3 年以上相关工作经验;
- 在语音识别、音乐理解、音频分类、声学事件检测或多模态理解领域有深入研究,具备大规模数据训练经验;
- 熟练掌握 PyTorch/DeepSpeed/Megatron等框架,有高性能推理优化经验者优先;
- 发表过领域顶级会议文章(NeurIPS、ICML、ICLR、ACL、ICASSP、Interspeech等)、相关实习经验或者ACM竞赛获奖者优先。