【蚂蚁星】算法工程师-AIGC-灵光-27届
Company Antgroup
Focus Tech · Algorithm
Location 北京, 杭州
Published May 14, 2026
岗位职责
部门介绍: 围绕多模态理解、AIGC算法、实时互动,建立核心算法能力。 探索前沿AI能力的边界,挖掘用户的潜在需求,打造创新产品功能。 持续提升算法核心竞争力,逐步拓展高频场景,助力灵光产品成功。 职位描述: 1.面向AGI创新产品,探索内容生成和创新互动模式。通过内容生成(图像/视频/3D),为用户打造全新的内容体验和交互模式; 2. 结合产品场景,进行文生图、图像编辑、视频生成、3D生成模型的研究优化,解决生产质量、可控性、生成效率等关键问题; 3. 基于SOTA基模,进行Continue Pretrain/SFT/RL相关的优化,评测模型能力,探索各种下游应用场景; 4.追踪领域前沿工作,包括但不限于实时视频生成、世界模型等方向,探索RLHF在视觉生成领域的scaling law等。
任职要求
1.具备扎实的大模型研发经验,深入理解DiT、Self-Forcing、RL算法、DMD蒸馏加速相关算法原理。有图像生成、视频生成或3D生成经验; 2. 熟悉AIGC应用数据准备的全流程,包括数据采集、清洗、标注等,对于如何人工合成高质量训练数据有深入的理解; 3. 具有出色的分析、解决问题的能力,能深入解决大模型训练、应用存在的问题,有自主探索解决方案的能力者; 4. 优秀的编程能力,熟练使用pytorch。熟悉推理和训练模型调优,分布式推理训练加速,有实操经验优先。
特色标签
3D资产生成、AI内容创作、Diffusion Transformer、Python、Transformer扩散模型、三维内容生成、人类偏好对齐、人类反馈强化学习、内容、分布式训练、前沿基础模型、图像、图像算法、图文音视频融合、增量预训练、多模态大模型、多模态算法、大模型算法、实时视频合成、并行计算、强化学习、强化学习人类偏好、当前最佳大模型、扩散变换器模型、持续预训练、指令微调、文本到3D模型、文本到图像生成、文本到视频生成、文本驱动图像合成、智能内容生成、最新顶尖预训练模型、机器学习、模型加速/性能优化、深度学习、生成式人工智能、监督式微调、监督微调、直播、短视频、算法工程化经验、继续预训练、视频、视频内容自动化、语言控制图像生成、跨模态理解