千问事业部-多模态生成算法专家-杭州/上海/北京
Company Quark
Focus Tech · Algorithm
Location 北京, 杭州, 上海
Published July 2, 2026
岗位职责
- 负责Chat场景的图像视频Agent应用优化。负责构建大规模Mult-Agent系统,并对视觉语言模型(VLM)进行高效的定制与微调,以驱动业务创新;
- 负责基于基础模型,进行文生图、文生视频、图像/视频编辑等AIGC技术能力的精调、优化,持续提升用户体验;
- 进行前沿Agent应用方向的技术预研,跟踪并评估行业前沿研究成果,主动探索其在业务场景中的可行性,并负责将有潜力的技术迅速落地为核心业务能力,驱动产品创新与运营效率提升。
任职要求
- 具备优秀的编程和算法设计能力,精通Python编程语言;
- 拥有扎实的Agent或AIGC技术基础,并具备将理论应用于实际问题的能力。在Multi-Agent系统、通用图像编辑、视频模型定制等一个或多个领域具备实践和落地经验;
- 具备良好的逻辑思维、沟通协作能力,并对前沿技术和新事物保持强烈的好奇心。
加分项:
- 具有优秀的基础算法、扎实的机器学习基础,在ACL、NeurIPS、CVPR等会议/期刊上发表论文者优先; 2. 具有优秀的代码能力,在ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先; 3. 在Agent、Chatbot、图像生成、视频生成等领域,主导过大影响力项目者优先。