岗位职责
团队介绍:Commercial AI 负责中国交易与广告的to B应用统一模型建设,包含基础模型能力、AI Infra、统一商业数据、评测等方向。
ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。
- 负责LLM/VLM/Omni/Diffusion大规模分布式训练与推理基础设施的研发,深度优化计算、通信与存储性能,保障(多至)千卡任务集群的高效运行;
- 针对NVIDIA GPU(CUDA/Triton)、NPU进行深度性能调优,包括算子融合、显存管理优化、通信算子重叠(Overlap)等,将硬件算力发挥到极致;
- 设计并实现高性能LLM/VLM/Omni/Diffusion模型推理引擎,优化计算图编译、动态Batching及KV Cache管理,打造极致低延迟与高吞吐的线上服务架构;
- 技术演进与落地:持续跟进业界最新的Infra技术(如FlashAttention演进、高效通信库、FP8/INT8量化、稀疏蒸馏等训练部署方案),配合实际业务驱动技术预研并转化为生产力。
任职要求
- 2027届本科及以上学历在读,计算机相关专业优先;
- 熟练掌握C++/Python,精通数据结构与算法,并有并发编程基础;熟练使用PyTorch/TensorFlow或其他深度学习框架,熟练掌握深度学习性能加速技术包括但不限于计算图优化,算子性能优化,通信优化等;
- 具有LLM/VLM/Omni/Diffusion模型训练/推理优化经验,熟悉TensorRT-LLM、vLLM、LightX2V等推理效率优化工具;
- 积极主动有热情,具备较强的沟通能力以及优秀的团队协作能力;
- 对于AI-Native代码工作流程有思考、有经验者优先,实践动手能力强,ACMICPC,NOI/IOI,Top Coder,Kaggle比赛获奖者优先。