多模态生成大模型算法工程师

Campus

Company Meituan

Focus Tech · Algorithm

Location 北京, 上海, 深圳

Published August 17, 2026

岗位职责

  1. 负责通用视觉技术能力的构建,如OCR、人脸人体分析、图像视频理解、3D视觉、图形和渲染算法、基础模型、跨模态理解与生成、MLOps等;
  2. 负责视觉技术在美团全场景下的落地,包括但不限于内容审核、视频结构化理解、智能文档分析、身份核验、智能创作、自动驾驶、场景数字化、摄像头视觉感知、视频流分析、IoT视觉等;
  3. 负责前瞻技术的探索及攻坚,如生成式AI、神经网络渲染、点云处理、增强现实等。

任职要求

  1. 本科及以上学历;

  2. 熟练掌握模式识别和图像视频处理领域的基础理论和方法,在一个或多个领域有深入研究;在机器学习和深度学习方面具备扎实的理论基础和工程实现能力,熟悉PyTorch、TensorFlow等主流框架;

  3. 优秀的分析和解决问题的能力、项目推动力和团队协作能力。 具备以下经验者优先

  4. 在计算机视觉领域内的权威期刊(TPAMI, TIP, IJCV, TMM等)或顶级会议(CVPR,ICCV,ECCV等)发表过文章;

  5. 在计算机视觉的通用或细分领域的权威竞赛中取得成绩;

  6. 对视频内容理解、行人再识别、深度学习模型压缩、弱监督学习、对抗学习等领域之一有过深入研究。 岗位亮点

  7. 以公司实际业务为依托,有完善的技术转化和落地机制;

  8. 场景全覆盖,视觉技术方向的选择空间大;

  9. 注重技术创新,关注前沿技术;

  10. 定制化的新人培养计划,可走领域专家培养路线,也可走架构师培养路线。