千问事业部-音频多模态生成算法专家-杭州/北京/上海

Company Quark

Focus Tech · Algorithm

Location 北京, 杭州, 上海

Published October 9, 2026

岗位职责

  1. 负责音频多模态生成大模型的研发,包含语音合成、音乐生成、音效生成和歌曲生成等任务的基础研究和应用落地;
  2. 研发基于扩散模型(Diffusion Models)或自回归模型(AR)的音频生成算法;
  3. 研究音频表征、强化学习或语音端到端等技术方向。

任职要求

  1. 计算机、信号处理、数学等相关专业硕士/博士学位,3 年以上相关工作经验;
  2. 在语音合成、音乐生成、音效生成或语音端到端等领域有深入研究,具备大规模数据训练经验;
  3. 熟练掌握 PyTorch/DeepSpeed/Megatron等框架,有高性能推理优化经验者优先;
  4. 发表过领域顶级会议文章(NeurIPS、ICML、ICLR、ACL、ICASSP、Interspeech等)、相关实习经验或者ACM竞赛获奖者优先。

岗位标签

NEW