多模态大模型可控视觉生成底座研发与应用
Campus/Intern
Company Jd
Focus Tech · Algorithm
Location 北京
Published July 20, 2026
岗位职责
- 负责电商零售多模态大模型的基座研发,以及支持电商全域场景的多模态应用落地。
- 研发支持多模态参考信息的可控电商素材生成基座模型,并利用AIGC能力赋能商家平台。
- 负责视觉/多模态、AIGC大模型技术的创新与优化,涵盖数据构建、模型设计、效果迭代与评估全流程。
- 负责多模态大模型的预训练、增量预训练与后训练相关工作,包括模型结构升级与多模态大模型(VLM)评测等。
任职要求
- 计算机及数理等相关领域的本硕博在校生。
- 对LLM/VLM、预训练/后训练、SFT/强化学习、Diffusion Model、DiT等前沿技术有深入理解与实操经验。
- 编码能力强,有极高的技术追求,具备出色的业务抽象表达沟通与团队合作能力。
- 在CVPR/ECCV/NIPS/ICLR等顶会或顶刊有论文发表经历优先;在重要算法或ACM比赛中取得优秀名次者优先。
- 有通用生图大模型、可控生成与编辑、或电商AIGC落地(如AI模特/海报生成)等项目经验者优先。
部门/板块
京东零售