研究型实习生-声纹识别模型
Company Antgroup
Focus Tech · Other
Location 北京, 上海, 杭州
Published May 28, 2026
岗位职责
研究领域: 智能语音信号处理 项目简介: 当前声纹识别主要集中研究单一类型设备下识别的准确率,对多设备,跨设备的研究较少且一直存在性能挑战。不同终端设备在收音硬件、信号处理算法等方面的差异,会导致声纹特征表征不一致,进而影响识别系统的泛化能力。目前存在的主要问题包括: 1. 模型普适性不足:针对不同设备往往需定制化开发专用模型,难以实现统一架构下的跨设备适配;2. 跨设备识别性能瓶颈:在设备间声学特性差异显著时,声纹特征的匹配精度明显下降。随着语音交互的普及和更多智能设备涌现,声纹识别将赋能于手机、平板、智能眼镜、车机、耳机、音响、智能家电等。同时希望声纹最终实现“一端注册,多端识别”的目标,这对多/跨设备声纹识别提出了迫切的技术需求。因此,开展“多设备跨设备声纹识别”的相关研究,具有重要的理论价值与实践意义。
任职要求
研究领域: -目前正在攻读计算机科学或相关STEM领域的学士,硕士或博士学位 -具有一种或多种通用编程语言的经验,包括但不限于: Java,C/C ++ 、Python、JavaScript或Go -具有上述研究领域的相关经验,包括行业经验或作为参与实验室研究 优先录用: -对技术研究充满热情,具有产生新思想和创新的能力; 在自学,问题分析和解决方面表现出色 -在国际会议上或核心期刊发表一份或多份出版物或论文 -至少3个月的全职工作
特色标签
C/C++、Java、Python、单点注册多点识别、声学属性、声学相关专业、声纹特征、多端设备、异构设备、数学/统计相关专业、有国际期刊/会议论文发表、模型微调、模型迁移、统一注册跨端识别、英文读写能力良好、计算机相关专业、设备间迁移、语音、语音前端处理、语音识别工作经验、说话人特征、说话人识别、说话者识别、跨域适应能力、跨端、通信/信号处理相关专业、通用性、音频信号处理、音频特性