jdwatch
  • Home
  • CLI
  • Skills
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

蚂蚁国际-语音算法高级专家-全球技术

Company Antgroup

Focus Tech · Algorithm

Location 上海, 杭州

Published August 27, 2026

岗位职责

我们是蚂蚁国际语音 AI 技术团队,致力于构建面向全球用户和真实商业场景的下一代语音智能系统。 团队服务于蚂蚁国际多个海外业务,语音 AI 已应用于 AI 销售、AI 客服等核心场景,覆盖 10 多个国家和地区,支持多语种交互。不同国家在语言、口音、文化习惯和业务流程等方面存在显著差异,为语音系统的自然度、智能度、实时性和稳定性带来了丰富而复杂的技术挑战,也为前沿技术创新提供了广阔空间。 在这里,你将有机会面向大规模、国际化的真实业务场景,推动前沿语音技术从模型创新走向产品落地,为全球用户打造更自然、更智能的语音交互体验。

职位描述 我们正在招聘一位在端到端语音大模型、实时多模态模型或全双工语音交互方向具有深厚积累的高级算法专家,负责核心技术路线设计、关键模型研发及规模化业务落地。 你将:

  • 负责端到端全双工语音大模型的技术路线规划、架构设计、训练优化与业务落地。
  • 研发 Speech-to-Speech 统一模型,实现边听边说、自然打断、低延迟响应和情感化表达。
  • 推进语音 Tokenizer、流式建模、多模态对齐、后训练及推理加速等核心技术研发。
  • 面向 AI 销售、AI 客服等真实业务场景,提升模型在复杂对话、任务执行和持续交互中的表现。
  • 建设高质量的数据生产、模型训练与评测体系,持续提升多语言语音交互的自然度、智能度、稳定性和可控性。
  • 推动模型在多语言、多人对话及复杂环境中的应用与迭代,解决跨国家、跨语言场景下的关键技术问题。
  • 与产品、工程及业务团队紧密协作,将前沿研究成果转化为稳定、可规模化交付的产品能力。

任职要求

  • 在端到端语音大模型、Speech-to-Speech、实时多模态模型或全双工语音交互等方向具备扎实的研究积累和工程经验。
  • 熟悉语音 Tokenizer、流式生成、多模态对齐、模型后训练或低延迟推理等关键技术。
  • 对语音与大语言模型的融合具有深入理解,能够从系统层面解决理解、生成、交互与任务执行等问题。
  • 具备较强的技术判断力和系统设计能力,能够独立推动复杂算法项目从技术选型、模型研发到产品落地。
  • 具备良好的协作与沟通能力,能够与算法、工程、产品及业务团队共同解决复杂问题。

满足以下条件者优先:

  • 主导或深度参与过已上线的 Omni 或 Realtime 语音大模型。
  • 具备真正全双工、多人对话或多语言语音系统的研发经验。
  • 在相关领域发表过高水平论文,参与过具有影响力的开源项目,或拥有规模化产品落地成果。

岗位标签

NEW

特色标签

Docker/Kubernetes、Python、TensorFlow/PyTorch、WebRTC、低时延模型部署、全双工语音对话、国际化、在线语音生成、声音文本对齐、多语种语音识别与合成、多语言口语交互、大规模语音模型、实时双向语音、实时推理优化、实时流处理、客服、小语种国家留学生、支付、有国际期刊/会议论文发表、有留学背景、欧洲留学生、毫秒级响应、流式语音建模、澳加留学生、端到端语音对话模型、聊天机器人、英文读写能力良好、英美留学生、语音、语音到语音直接转换、语音基础模型、语音大参数模型、语音对语音统一模型、语音离散化编码器、语音离散单元化、语音量化器、跨境、跨模态特征对齐、跨语种语音、边说边听交互、金融、音视频语义对齐