千问事业部-音频多模态生成算法专家-杭州/北京/上海
Company Quark
Focus Tech · Algorithm
Location 北京, 杭州, 上海
Published July 2, 2026
岗位职责
- 负责音频多模态生成大模型的研发,包含语音合成、音乐生成、音效生成和歌曲生成等任务的基础研究和应用落地;
- 研发基于扩散模型(Diffusion Models)或自回归模型(AR)的音频生成算法;
- 研究音频表征、强化学习或语音端到端等技术方向。
任职要求
- 计算机、信号处理、数学等相关专业硕士/博士学位,3 年以上相关工作经验;
- 在语音合成、音乐生成、音效生成或语音端到端等领域有深入研究,具备大规模数据训练经验;
- 熟练掌握 PyTorch/DeepSpeed/Megatron等框架,有高性能推理优化经验者优先;
- 发表过领域顶级会议文章(NeurIPS、ICML、ICLR、ACL、ICASSP、Interspeech等)、相关实习经验或者ACM竞赛获奖者优先。