jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

蚂蚁集团-语音大模型评测工程师-健康事业群

Company 蚂蚁集团

Focus 技术 · 算法

北京, 杭州

July 30, 2026

岗位职责

团队介绍 负责医疗语音大模型的研发和应用,覆盖语音前端DSP、3A、VAD、ASR、TTS等核心技术方向,并持续探索原生多模态等前沿技术方案,推动语音与多模态能力在医疗场景中的技术突破。 聚焦医疗健康领域核心场景,打造行业领先的AI产品,包括泛医疗助手、医护办事等应用,提升医疗行业用户体验与服务效率,助力支付宝医疗健康迈向智能化新时代。 研究和跟踪语音智能、大模型、多模态等前沿技术发展,探索AI助力医疗普惠、医疗服务智能化的新范式。 职位描述 负责医疗语音大模型及相关语音能力的评测体系建设,围绕S2T/ASR/TTS、语音通话、数字人、医疗语音交互等场景,设计评测方案、构建评测标准并持续优化。 结合业务目标与模型能力,定义核心评测指标,包括但不限于识别准确率、延迟、稳定性、自然度、可懂度、鲁棒性、安全合规性、医疗场景可用性等,并建立可量化、可追踪的评测机制。 负责搭建语音大模型离线评测、在线评测与专项评测能力,建设测试集、基准集和场景化评测集,覆盖真实医疗场景中的口音、噪声、术语、通话链路、长语音、多轮交互等复杂问题。 与语音算法、数据、产品、工程团队紧密协同,深入分析模型效果问题,定位性能瓶颈,推动ASR/TTS/语音大模型在医疗业务中的效果优化与目标达成。 参与评测自动化平台、评测工具链和数据闭环建设,推动评测流程标准化、工程化和规模化,提升模型迭代效率。 持续跟踪语音大模型、多模态、数字人、智能通话等方向的前沿评测方法与行业最佳实践,推动评测体系不断升级。

任职要求

本科及以上学历,语音、计算机、人工智能、机器学习、多模态等相关专业,2年以上语音算法、语音测试、模型评测或相关工作经验。 熟悉语音相关核心技术原理,理解语音前端、唤醒、VAD、ASR、TTS、语音通话处理、端到端语音模型及原生多模态模型的基本机制与常见问题。 具备语音模型评测体系设计经验,能够独立设计评测维度、指标体系、测试方案和数据集,具备较强的问题分析与效果归因能力。 熟悉语音交互系统或语音产品落地流程,了解业界主流语音系统实现方案,有医疗语音、客服通话、数字人、智能助手等相关场景经验者优先。 具备良好的工程能力,熟悉Python,了解C/C++,能够完成评测脚本开发、数据分析、自动化评测流程搭建及相关工具开发。 具备较强的跨团队协同和项目推动能力,能够与算法团队高效配合,推动模型效果持续优化并落地业务目标。 有大模型开源项目经验、医疗应用场景实操经验者优先;有人工智能、语音、多模态等方向顶会/顶刊论文发表者优先。

岗位标签

NEW

特色标签

AI、C++、CI/CD、Golang、Java、Jira、LLM、MySQL、PHP、Python、Selenium、TestNG、人工智能、医疗、医疗业务、医疗场景、可靠性、多模态交互、多模态处理、大语言模型、定制化、持续交付、数据分析、智能体、测试工具、特征工程、用户定制、算法工程、算法链路、计算机相关专业、质量保障、高品质稳定性

Apply now

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.