jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

Token Foundry-语音识别/语音大模型算法专家-Qwen Audio

Company 通义实验室

Focus 技术 · 算法

北京, 杭州

July 29, 2026

岗位职责

  1. 主导多模态理解/音频大模型的前沿算法研究及产业落地。
  2. 音频理解方向: (1)研发语音识别、语音翻译以及音频分析等理解算法。 (2)开发跨模态(语音/文本/视觉)的音频语义理解系统。 (3)探索音频大模型架构设计。 (4)推动算法成果转化:通过ModelScope开源社区创造研究价值,或通过阿里云产品体系创造商业价值。 (5)持续跟踪国际前沿技术动态(ICASSP/Interspeech/NeurIPS/ICLR等),参与国际会议、研讨会,与全球顶级团队进行交流合作。

任职要求

  1. 计算机科学、信号处理、语音处理、人工智能等相关领域硕士及以上学历。
  2. 2年以上音频AI研发经验,包括但不限于 音频识别及理解、音频生成、数字人、多模态交互 等方向。
  3. 扎实的深度学习基础,熟练掌握PyTorch/TensorFlow等框架。
  4. 优秀的编程能力(Python/C++),具备大规模音频数据处理经验。
  5. 良好的跨团队协作能力,对技术落地有强烈热情。

加分项:

  1. 在音频、多模态、机器学习顶会或期刊发表过相关论文。
  2. 深入了解语音在各类业务场景应用落地的相关挑战。
  3. 具备多模态(语音+视觉+文本)交互系统研发及落地经验。

岗位标签

NEW

Apply now

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.