岗位职责
团队介绍:Data AML是字节跳动的机器学习中台,为抖音/今日头条/西瓜视频等业务提供推荐/广告/CV/语音/NLP的训练和推理系统。为公司内业务部门提供强大的机器学习算力,并在这些业务的问题上研究一些具有通用性和创新性的算法。同时,也通过火山引擎将一些机器学习/推荐系统的核心能力提供给外部企业客户。
- 探索研究多模态理解、强化学习、计算机视觉Agent等前沿技术;对多模态模型能力和理想态的差距保持敏感,评测和优化提升多模态模型的能力极限;
- 专注提升多模态大模型在现实世界复杂任务的效果,追求通用可规模化的方法,优化领域包括但不限于视觉推理、Streaming video交互、多模态Agent、大规模数据合成、Mid-training等方向;
- 推动多模态大模型在成本/效率方面的极致优化,包括但不限于大规模蒸馏/自蒸馏、Efficient reasoning、极致的Video压缩等方向;
- 依托公司和业界的大模型和基础CV技术,构建面向To B业务应用的多模态算法能力,帮助业务取得成功。
任职要求
- 2027届获得硕士及以上学位,计算机、数学等相关专业优先;
- 具有优秀的基础算法、代码能力,熟练掌握C/C++或Python编程语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 具有扎实的计算机视觉、机器学习基础,熟悉CV、AIGC、NLP、RL等技术领域,在CVPR、ECCV、ICCV、NeurIPS、ICLR、SIGGRAPH或SIGGRAPH Asia等顶级会议上发表论文者优先;
- 在大模型领域或者RL领域,主导过大影响力的项目者优先;
- 具有出色的分析、解决问题的能力,能深入解决大模型训练和应用存在的问题,有自主探索解决方案的能力者优先;对AI技术的实际落地和突破性应用充满热情,追求技术创新与现实价值的结合;
- 具有良好的沟通协作能力,工作积极主动,能够与团队融洽合作,一起探索新技术,推进技术进步。