jdwatch
  • Home
  • CLI
  • Skills
  • Blog
  • FAQ
  • Pricing
Sign In
Sign Up
jdwatch

Job aggregation tool from multiple recruitment sources.

© Copyright 2026 JDWatch. All Rights Reserved.

Get Started
  • Sign In
  • Sign Up
Legal
  • Terms of Service
  • Privacy Policy
  • Refund Policy
  • Cookie Policy
Contact
  • service@jdwatch.work

智能算法产品事业部-视频理解和生成算法工程师-杭州/北京

Company Taotian

Focus Tech · Algorithm

Location 北京, 杭州

Published August 25, 2026

岗位职责

我们是淘天 AI 原生应用—内容 AI 团队,专注于 AIGC 与多模态理解技术 的研发与落地,面向淘宝商家、搜索推荐、外投等多个业务场景,提供视频与内容生成能力支持。团队研发的技术已在业务中规模化应用,每天生成数十万条 AI 视频,并为淘宝外投业务贡献了超过 40% 的消耗规模。重点研究方向包括可控视频和内容生成、多模态细粒度理解、内容创意 Agent 等,致力于研发真正满足业务需求、兼具效果与成本优势的业务域模型。团队与国内多所高校及实验室保持密切合作,近年来累计发表 30+ 篇顶会论文,涵盖理解和生成统一模型,强化学习算法,多模态推理等最新前沿研究方向。如果你对相关技术感兴趣,欢迎加入我们

在这里,你将参与淘天核心业务场景下的视频理解与生成算法研发,围绕商家内容生产、搜索推荐、广告外投等场景,推动下一代内容 AI 技术从研究走向大规模应用。具体包括:

  1. 负责垂类视频生成模型的设计、训练与优化,面向电商场景构建高质量、可控、低成本的视频生成能力。
  2. 负责视频理解、多模态细粒度理解相关算法研发,提升对商品、人物、场景、动作、镜头语言等内容的识别与建模能力。
  3. 参与视频创作 Agent 的研发,结合大模型、多模态理解与生成能力,打造面向真实业务需求的智能创作系统。
  4. 结合业务目标优化模型效果、推理效率与部署成本,支撑大规模线上生产与应用。
  5. 跟踪多模态生成与理解领域前沿进展,推动论文成果、开源能力与业务系统结合

任职要求

  1. 计算机、人工智能、数学、电子工程等相关专业,硕士及以上学历优先。

  2. 具备扎实的机器学习、深度学习基础,熟悉 Transformer、Diffusion、VAE、LLM、多模态模型等主流技术。

  3. 在以下至少一个方向有较强实践或研究经验:视频生成 / 图像生成、视频理解 / 多模态理解、 LLM&Agent

  4. 对真实业务问题有兴趣,能够将前沿算法与业务目标结合,推动技术落地。

  5. 具备良好的问题分析能力、沟通协作能力和自驱力。