(大模型专项)多模态大模型算法工程师
Company Kuaishou
Focus Tech · Algorithm
Location 北京
Published April 20, 2026
岗位职责
我们是谁
快手本身是一家以内容为主的公司,在大模型技术蓬勃发展的时代,多模态能力是快手非常重视的一个方向。目前团队主要的工作重心在视频理解和图片理解,包括短视频、长视频、直播、交互式视频等,主要的任务形态以Caption和QA为主,同时在生成类场景发挥着重要的作用。团队的主要工作围绕在数据组织、模型设计、训练范式设计上,会推出基座模型给到下游业务进行SFT,部分业务是紧密合作的。模型迭代会以业务反馈作为牵引,不断提升在自建指标和公开指标上的成绩。
职位描述 1、探索多模态理解任务上的自研数据构建、模型架构和训练范式,打造业界第一梯队的多模态大模型; 2、搭建更有针对性的评测,用于真实反映模型的实用效果,为模型训练提供指导方向; 3、强化Caption和QA能力,在图片/视频的理解/描述能力上赶超GPT4o、Gemini Pro等闭源模型的实际使用效果; 4、洞察业务需求,能够以业务目标为牵引持续迭代模型,在支持好业务的同时,发掘多模态的独立出圈应用玩法; 5、探索技术边界,将有特点的技术成果进行学术转化,在顶尖学术会议上发表论文,并保持与业界专家的交流。
任职要求
1、硕士及以上学历,有较强的代码动手开发能力,对多模态大模型基座能力提升有较高的热情; 2、熟悉计算机视觉相关的算法和技术,有自然语言处理和大模型训练经验; 3、良好的沟通协作能力,能够与团队紧密合作,共同推进项目进展; 4、在ACM/ICPC、Top Coder、Kaggle等比赛中取得过良好成绩是加分项; 5、在大模型领域,有主导过具有重要影响力的项目或发表过相关论文是加分项。