多模态生成大模型算法工程师
Campus
Company Meituan
Focus Tech · Algorithm
Location 北京, 上海, 深圳
Published August 17, 2026
岗位职责
- 负责通用视觉技术能力的构建,如OCR、人脸人体分析、图像视频理解、3D视觉、图形和渲染算法、基础模型、跨模态理解与生成、MLOps等;
- 负责视觉技术在美团全场景下的落地,包括但不限于内容审核、视频结构化理解、智能文档分析、身份核验、智能创作、自动驾驶、场景数字化、摄像头视觉感知、视频流分析、IoT视觉等;
- 负责前瞻技术的探索及攻坚,如生成式AI、神经网络渲染、点云处理、增强现实等。
任职要求
-
本科及以上学历;
-
熟练掌握模式识别和图像视频处理领域的基础理论和方法,在一个或多个领域有深入研究;在机器学习和深度学习方面具备扎实的理论基础和工程实现能力,熟悉PyTorch、TensorFlow等主流框架;
-
优秀的分析和解决问题的能力、项目推动力和团队协作能力。 具备以下经验者优先
-
在计算机视觉领域内的权威期刊(TPAMI, TIP, IJCV, TMM等)或顶级会议(CVPR,ICCV,ECCV等)发表过文章;
-
在计算机视觉的通用或细分领域的权威竞赛中取得成绩;
-
对视频内容理解、行人再识别、深度学习模型压缩、弱监督学习、对抗学习等领域之一有过深入研究。 岗位亮点
-
以公司实际业务为依托,有完善的技术转化和落地机制;
-
场景全覆盖,视觉技术方向的选择空间大;
-
注重技术创新,关注前沿技术;
-
定制化的新人培养计划,可走领域专家培养路线,也可走架构师培养路线。