岗位职责
团队介绍:视频与边缘部门承载了字节跳动的媒体内容分发基建及技术中台,支持了字节跳动全系产品,如抖音、今日头条、番茄小说、西瓜视频等APP的点播、直播、实时通信、图片等多媒体业务发展,同时将业务发展过程中沉淀下来的技术能力和工具,通过火山引擎对外输出,面向各行各业用户提供视频云产品和服务,愿景是为内外部业务伙伴提供最低成本、最优画质、最低延时、最安全可靠的富媒体内容分发解决方案,助力业务伙伴降本提效实现持续增长。
- 参与视频理解与画质分析算法的研究和落地,方向包括视频内容理解、时序建模、ROI/SOD、事件定位、视频价值评估等;
- 探索多模态大模型在视频理解、画质评估、生成式增强、交互式视频处理等方向的应用,推动前沿技术在真实业务中验证和落地;
- 参与主客观画质评价、局部画质劣化检测、可解释质量分析等QoE算法建设,支撑点播、直播、推荐、端上策略、转码增强等业务场景;
- 参与端到端视频体验优化方案设计,将视频分析、画质评估、视频处理和编码策略结合起来,提升用户观看体验和处理效率;
- 参与数据集构建、算法训练与优化、线上监控、客观评测、A/B实验和效果归因,与产品、工程、推荐、转码等团队协作,验证算法效果和业务收益。
任职要求
- 2027届获得硕士及以上学位,计算机、电子工程、通信、数学等相关专业优先;
- 具备扎实的机器学习、计算机视觉、图像/视频处理基础,对多模态视频理解、视频质量评价、画质增强或视频编码策略中的一个或多个方向有学习、研究或项目经验,并有视频中长时序理解、temporal grounding、Few-Shot质量评估、用户偏好建模、像素级质量检测、生成式画质增强等相关项目经验者优先;
- 具备较强学习能力、问题拆解能力和实验设计能力,能够从数据和实验结果中定位问题,并持续优化算法效果;
- 有相关方向论文、竞赛、科研项目、实习经历,或在CVPR、ICCV、ECCV、NeurIPS、ICLR、AAAI、ACM MM等会议/期刊发表论文者优先;
- 熟悉深度学习框架和主流模型结构(包括PyTorch/TensorFlow、Transformer、多模态大模型等),熟练掌握C/C++、Python中至少一种编程语言,具备良好的代码实现能力和工程意识,熟悉OpenCV、FFmpeg、sklearn等图像/视频处理工具,了解Linux开发环境、Shell、HDFS等工具者优先。