音视频AI应用工程师(音频方向)
Company Kuaishou
Focus Tech · Backend
Location 杭州
Published June 23, 2026
岗位职责
1、研究前沿语音、语言、多模态模型在音频生产与消费场景中的应用技术; 2、负责音频AI能力的全链路工程落地,涵盖模型集成、服务化部署、性能优化等核心环节; 3、应用前沿模型,提升音频相关业务产品的质量和用户体验; 4、通过量化、剪枝、推理加速等手段对模型进行调优,满足业务场景对精度与延迟的要求; 5、面向音频业务场景建设数据集,包括数据采集、标注工具开发、数据质量分析与清洗; 6、为业务产品提供AI解决方案,包括但不限于实时流式处理、离线批量处理、AI工作流等。
任职要求
1、本科及以上学历,计算机、人工智能、自动化、信号处理、数学专业优先; 2、对大模型底层原理有基本理解,能跟踪语音、语言及多模态领域前沿技术动向; 3、扎实的编程基础,对数据结构与算法有深入了解,熟练掌握 Python/C++ 等主流语言一种或多种; 4、熟悉 PyTorch、ONNX、TensorRT、HuggingFace/transformers 等框架和库的一种或多种; 5、熟悉模型推理优化技术,如量化、剪枝、算子融合等,有实际落地经验者优先; 6、熟悉音频相关工程技术,如语音活动检测、说话人分离、音频增强等的一种或多种; 7、具备强大的工程能力,能快速将模型能力集成到线上服务,关注服务稳定性、推理性能与延迟优化; 8、有 ACM/IOI/NOI 等算法竞赛获奖经历优先; 9、责任心强,积极主动,有良好的沟通与协作能力,能主动推动业务落地。