大模型数据架构工程师-【可灵AI专项】
Company Kuaishou
Focus Tech · Algorithm
Location 北京
Published July 24, 2026
岗位职责
1、负责打造可灵生成式大模型的数据基础设施,构建高性能、分布式、可扩展的数据系统,通过数据驱动模型生产,使模型可以在海量数据场景下完成高效的算法迭代; 2、构建 agentic 数据生产体系:将数据基建能力封装为 agent 可靠调用的工具与服务,研发数据链路的编排与运行框架——让数据管线的搭建、运维、排障逐步由 agent 自主完成; 3、攻坚以下领域之一的核心架构难题(详见任职要求的方向说明):大规模分布式计算与调度 / 海量多模态存储 / 跨模态检索 / 大规模批量推理优化 等; 4、建设数据管线的无人值守能力与全链路可追溯:作业级容错与自愈、自动化质量监测、数据版本化与血缘、数据实验归因体系; 5、与算法、数据交付团队进行紧密合作,共同定义算子与数据服务的接口标准,以Co-Design方式共同提升模型效果。
任职要求
1、计算机及相关专业本科及以上学历,3 年以上基础架构方向研发经验; 2、精通至少一种系统语言(C++/Go/Rust/Java)及 Python,有大规模生产系统的性能优化实战,吞吐/延迟/成本有可量能力; 3、对自己深耕的技术领域,能深刻理解其技术边界,深耕领域见下方描述; 4、具备能力抽象功底:能把复杂基建收敛为清晰的 API 与服务接口,以"agent 能可靠调用、失败可重试、状态可观测"为接口标准; 5、善用 AI-coding 与大模型工具(硬性要求),认同 agentic 研发理念; 6、沟通务实,尊重相邻方向的专业判断。
方向长板(以下四选一,至少一个方向达到深耕水平): 1、分布式计算与调度:精通 Ray/Spark/Flink 之一的内核机制与调优,有亿级样本处理管线或大规模混合负载(CPU 解码 × GPU 推理)的实战;熟悉 Kubernetes 批调度、GPU 调度、潮汐混部者优先; 2、存储与数据湖:精通对象存储/数据湖/分布式缓存之一的内核或深度实践,有海量小文件、高吞吐顺序读写、元数据规模化管理的实战;做过数据版本化或血缘系统者优先; 3、检索与索引:精通向量检索引擎(Faiss/Milvus/自研 ANN)或大规模倒排/多维索引,有亿级 embedding 的建库、召回调优、增量更新实战;做过跨模态检索(文搜视频/以图搜视频)者优先; 4、推理优化:精通 vLLM/SGLang/TensorRT 类推理框架,有大规模离线批量推理系统的建设经验——动态 batching、量化加速、多模型混部、显存与吞吐调优;做过视觉/多模态模型推理优化者优先。
加分项(各方向通用): 1、有多模态/视频数据处理基建经验(视频编解码、GPU 视频处理管线、BMF/Ray Data 类框架); 2、参与过知名开源基建项目。