岗位职责
团队介绍:抖音致力于打造一个开放、积极、多元、友善的平台,鼓励表达、沟通和记录,激发创造,丰富人们的精神世界,让现实生活更美好。我们通过AI算法驱动的个性化推荐与智能创作工具,满足用户表达、学习、娱乐、社交、消费等需求。回顾抖音一路走来的历程,我们在帮助亿万用户记录美好生活的过程中,努力变得更好。
- 负责字节跳动泛体验和泛质量领域各业务场景下,多模态算法应用研究与落地工作,业务场景包括但不限于抖音生态优质、抖音生态治理、视觉生成Judge、内容理解等场景;
- 跟踪多模态领域的最新研究成果,用以持续提升算法应用效果;研究方向包括但不限于:多模态大模型架构(VLM、MLLM)、多模态推理(视觉Token压缩)、多模态理解与视觉生成等前沿技术;
- 深度参与项目研发,和产品、运营、研发、质量等同学密切配合,注重研发效率和业务收益。
任职要求
- 2027届获得本科及以上学历,计算机、软件工程等相关专业优先;
- 具备多模态相关算法的扎实基础,包括但不限于自然语言处理、计算机视觉、视频理解、强化学习、LLM等领域的全面学习和实践经验;
- 熟悉主流的Transformer及大模型架构,了解GPT/LLaMA、ViT/CLIP、LLaVA/Qwen-VL等语言、视觉及多模态代表性模型;熟练掌握PyTorch等主流深度学习框架;
- 有较强的业务问题到算法模型的建模能力,有强烈的技术好奇心、自驱力和进取心,能及时关注和学习业界最佳实践。
加分项:
- 具备优秀工程能力,有数据处理经验者优先;
- 有国际顶级会议(ACL/EMNLP/IJCAI/AAAI/SIGIR等)期刊论文发表者优先。