视频生成强化学习算法专家 -【可灵AI】
Company Kuaishou
Focus Tech · Algorithm
Location 北京
Published April 24, 2026
岗位职责
1、负责视频生成大模型以及多模态控制的视频生成的强化学习算法研究与开发,优化模型训练效果、稳定性和效率; 2、深入研究前沿的强化学习算法,结合可灵视频生成业务场景,探索和落地新的算法优化方向,保持公司在该领域的技术领先性; 3、深入研究面向视频生成的多目标强化学习及奖励模型(Reward Model)设计,提升模型在复杂任务中的表现; 4、撰写高质量技术报告与论文,与团队共同推动技术创新,保持行业领先地位。
任职要求
1、在以下至少一个方向有深厚的项目经验和技术洞察力:生成模型、多模态学习、强化学习、模型对齐; 2、在以下至少一个AI领域有丰富的知识积累和前沿视野:大规模生成模型,多模态AI,计算机视觉、视频理解/生成等; 3、具备出色的编程能力和算法实现能力,熟悉主流深度学习框架(如PyTorch),并有大规模模型训练调优经验。
加分项: 1、作为核心贡献者,在计算机视觉或AI领域的顶级会议/期刊(如 CVPR, ICCV, ECCV, NeurIPS, ICML 等)上有相关学术成果发表; 2、在开源社区(如GitHub)发布过有影响力的项目; 3、具备强烈的自我驱动力、优秀的团队协作精神和解决前沿技术挑战的热情。