jdwatch
  • Home
  • CLI
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

业务技术-音频算法工程师-3A与智能语音交互方向

Company Taotian

Focus Tech · Algorithm

Location 北京, 杭州

Published July 31, 2026

岗位职责

  1. 负责3A核心算法的研发与迭代,包括回声消除(aec)、自动噪声抑制(ans)、自动增益控制(agc),确保算法在复杂声学环境下的鲁棒性,保障全双工通话的高保真音质与交互体验。
  2. 推动3A算法的轻量化部署与端侧适配,结合深度学习与传统信号处理技术,平衡算法性能与资源消耗,支撑智能体语音交互技术基座建设。
  3. 针对人机语音交互、智能体对话等前沿场景,优化VAD判停和语义完整性检查,实现“快速打断,智能判停,实时响应”的自然对话能力;
  4. 研发语音识别(ASR)、语音合成(TTS)技术,并探索交互式语音模型在智能体对话中的应用,搭建可控双流模型的数据,训练和评估体系,优化对话模型的边说边听和情感识别能力;
  5. 与产品、工程团队紧密合作,将算法模型落地到实际应用中,并持续优化系统性能。
  6. 跟踪学术界和工业界的最新进展,探索前沿技术在对话系统中的应用。

任职要求

  1. 计算机科学、人工智能、信号处理、声学等相关专业硕士及以上学历; 2. 精通3A算法原理与工程实现,熟悉语音识别(ASR)、语音合成(TTS)、语音对话与理解大模型等技术,有实际项目经验者优先;
  2. 熟练掌握Python、C++等编程语言,熟悉TensorFlow、PyTorch等深度学习框架。
  3. 具备扎实的机器学习、深度学习基础,熟悉Transformer、BERT、GPT等预训练模型。对人机语音交互、智能体技术有浓厚兴趣,具备良好的跨团队协作能力与技术攻坚意识。
  4. 在相关会议期刊(如ACL、EMNLP、ICASSP、Interspeech等)发表过相关论文优先。

岗位标签

NEW

You'll be redirected to the official careers page. You can also sign in to save jobs and search more roles.