大模型算法工程师-(AIGC / 多模态生成方向)-【商业化】
Company 快手
Focus 技术 · 算法
杭州
July 16, 2026
岗位职责
1、AIGC 模型能力建设:负责大模型 / 多模态生成模型在品牌广告场景中的能力优化,包括但不限于文生图、图生图、图生视频、视频生成、音频生成、数字人等方向,提升广告素材生成质量、可控性和稳定性; 2、品牌广告垂类模型优化:围绕品牌广告素材生产中的核心问题进行模型优化,包括品牌元素保真、Logo / 商品 / 文字一致性、安全区控制、构图版式约束、编辑一致性、素材美观度和广告感提升等; 3、模型微调与后训练:参与大模型 SFT、LoRA、Reward Model、偏好优化、蒸馏、量化等工作,结合业务数据构建品牌广告垂类模型能力,提升模型在真实广告场景中的生成效果; 4、评测体系与数据闭环建设:参与构建品牌广告 AIGC 评测体系,包括自动化指标、人工评测标准、Bad Case 分析、Benchmark 构建、数据清洗标注和效果回归,形成模型持续迭代闭环; 5、算法工程化落地:与工程团队协作,将模型能力封装为稳定可用的业务服务,参与推理服务、工作流编排、模型调用链路、效果观测、线上问题排查等工程化工作,推动算法能力真实落地到广告生产系统; 6、前沿技术探索:跟踪多模态生成、大语言模型、Diffusion、视频生成、图像编辑、模型蒸馏、强化学习等前沿技术,并结合品牌广告业务场景进行落地验证。
任职要求
1、工作经验:AIGC、多模态、计算机视觉或生成模型相关经验,要求具备独立承担子方向的潜力; 2、编程与工程基础:具备扎实的 Python 编程能力,熟悉 Linux 开发环境,熟练使用 PyTorch 等主流深度学习框架,有良好的代码习惯和实验管理能力; 3、模型基础:熟悉 Transformer、Diffusion、CLIP、VAE、DiT、LLM、Multimodal LLM 等基础模型原理,理解主流图像 / 视频 / 多模态生成模型的基本训练和推理流程; 4、AIGC 实践经验:至少在以下方向之一有实际经验:文生图、图生图、图像编辑、视频生成、图生视频、数字人、音频生成、素材理解、多模态评测; 5、训练与调优能力:了解或实践过 SFT、LoRA、DreamBooth、ControlNet、Reward Model、偏好优化、模型蒸馏、模型量化、推理加速等技术中的一种或多种; 6、数据与评测意识:具备较好的数据分析和实验对比意识,能够通过数据集构建、指标设计、A/B 实验、Bad Case 归因等方式判断模型效果,而不是只凭主观感受评估生成质量; 7、业务理解能力:对广告、营销、内容生成或创意生产有兴趣,能够理解品牌广告对素材质量、品牌一致性、可控性和商业效果的要求。
加分项: 1、有 AIGC 生成模型经验者优先:熟悉 Stable Diffusion、SDXL、Flux、Qwen-Image、Wan、CogVideo、HunyuanVideo、Seedance、可灵等图像 / 视频生成模型,有微调、蒸馏或推理优化经验; 2、有多模态理解经验者优先:熟悉 CLIP、BLIP、LLaVA、Qwen-VL、InternVL 等多模态模型,有素材理解、图文匹配、广告素材打标、内容质量评估经验; 3、有广告 / 内容场景经验者优先:参与过广告素材生成、智能审核、内容理解、营销创意生成、短视频生产、商品图生成、数字人营销等项目; 4、有模型评测或 Benchmark 经验者优先:做过生成模型评测体系、自动化评测指标、Human Preference、VLM-as-Judge、Bad Case 分析、数据集构建等工作; 5、有模型工程化经验者优先:熟悉 vLLM、Triton、TensorRT、ONNX、Diffusers、ComfyUI、Gradio、FastAPI 等工具,有模型服务化、推理加速、显存优化、部署上线经验; 6、有论文 / 开源贡献者优先:在 CVPR、ICCV、ECCV、NeurIPS、ICML、ICLR、ACL、EMNLP、AAAI、KDD 等会议发表过相关论文,或有高质量开源项目、模型训练经验、技术博客沉淀。