音频美学专家-【可灵AI专项】
Company 快手
Focus 技术 · 后端
北京
May 19, 2026
岗位职责
1、音频大模型数据质量管控与评估标准制定,参与音频在美学、声音设计、听觉叙事等维度的评估标准制定与落地,协助建立科学、系统的评估指标体系及评估方式,负责标注结果的质量审核与抽检验收,把控标注产出质量,推动质检工具与数据看板的产品化建设,通过数据分析追踪标注质量趋势与badcase,驱动持续优化闭环; 2、标注规则与规范管理,参与标注规则体系的设计与迭代,涵盖音频美学评估、音效语义描述、人声特征标注等多维度标准,协助推动规则落地,将业务需求转化为可执行的标注指南与SOP,确保标注团队高效、一致地执行,根据一线标注反馈持续迭代规则,解决边界场景与歧义问题; 3、标准落地提效与工具化,通过优化工作流、设计高质量Prompt、搭建标注辅助 Agent 等方式,持续提升标准落地的效率与精度,与产品、算法团队深度协作,将审美标准和数据洞察转化为可被模型理解与对齐的训练信号,推动模型听觉表现的系统性提升; 4、跨团队协同与项目管理,配合与算法团队的协作,协助执行标注策略与优先级安排,统筹标注执行团队的任务分配、进度跟踪与验收。协助搭建培训体系与考核机制,赋能供应商/子公司团队持续提升产出质量,参与标注平台与工具的产品优化,提升标注流程效率与使用体验。
任职要求
1、优先条件,有音频生成、语音合成等相关大模型数据构建与处理经验者优先,在多模态大模型音频相关数据工作方面有实践经验者优先,了解音视频生成模型产品(如Seedance、Kling等),对产品功能与生成效果有一定认知,能将产品视角纳入标准制定与质量评估者优先; 2、专业背景,本科及以上学历,声学、声音设计、音乐制作、影视声音设计等相关专业背景,声学及声音设计方向优先,具备扎实的理论功底,对音频技术体系有系统性认知; 3、专业技能,对音频美学、声音风格有敏锐的洞察力和深刻的理解,熟悉不同类型声音作品的设计手法,具备深厚且可阐释的音频审美能力,能够以客观、结构化、量化的方式描述音频质量的好坏,可精准区分音乐曲风、音效类型、声音设计手法及人声音色特征,不依赖模糊的感性判断,了解AI音频处理相关技术,熟悉数据标注流程和工具; 4、标准制定经验,有音频/音视频生成方向的数据标准制定或评测标准制定经验者优先,包括但不限于音乐生成、音效生成、语音合成、视频生成等领域; 5、项目管理能力,有数据标注项目管理经验者优先,熟悉大规模标注团队的工作流程、质量管控节点与团队协作机制,具备推进多方协同落地的执行力; 6、结构化表达能力,具备优秀的文字总结能力,擅长将主观、抽象的听觉特征转化为客观、具象、无歧义的文字描述,能够产出高质量的标准文档与规范。