Token Foundry-多模态算法专家/高级专家(理解与生成)-未来生活实验室
Company Tongyi
Focus Tech · Algorithm
Location 北京, 杭州
Published September 28, 2026
岗位职责
- 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。
- 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。
- 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。
任职要求
- 自然语言处理、机器学习、数据挖掘、人工智能等相关专业的硕士生/博士生;
- 熟练掌握Tensorflow、Pytorch等深度学习框架,扎实的编程基础,具备独立的算法实现能力;
- 有LLM实操经验,参与过大模型预训练,SFT,RLHF等项目;有垂域基座模型项目经验者优先,参与过大模型结合搜广推项目者优先;
- 良好的逻辑分析能力和数理基础,对算法原理及应用有较深入的理解,在人工智能相关的各类国际顶级会议/期刊中发表过论文者优先。
岗位标签
NEW