AI后端开发工程师(MJ030206)
Company 携程
Focus 技术 · 后端
Shanghai
June 2, 2026
岗位职责
职位描述
负责大规模语言模型(LLM)及其他AI模型的在线服务部署、性能调优与推理加速,确保高并发、低延迟、高可用的模型服务。
负责设计和开发智能Agent运行框架,实现核心模块,包括不限于知识库存储与检索(RAG)、Agent的长短期记忆存储、对接多模型协作协议(如MCP/A2A)等新型交互机制。
探索和落地模型压缩、量化、动态批处理、服务化框架优化(Triton/TorchServe等)等推理优化技术。
负责搜索推荐算法工程后端系统的设计、开发和维护,保障系统稳定高效运行,实现高并发在线特征工程、模型推理服务集成和服务质量监控等核心模块。
负责系统架构的设计、优化及核心模块的代码实现(Java为主)。
与产品经理、算法工程师、前端工程师紧密协作,理解需求,设计技术方案并推动落地。
负责系统的日常维护、监控、故障排查和性能调优。
任职资格
有算法平台开发或与算法团队深度合作经验,特别是模型部署、模型在线推理服务的实际项目经验。
具备大语言模型或复杂模型在线部署(Triton, TorchServe, TensorFlow Serving)、性能调优和推理加速的实际项目经验。
具备智能Agent系统核心模块(如知识库/RAG/记忆管理/工具调用)的设计或开发经验,熟悉相关框架(LangChain/LlamaIndex/MCP/A2A协议)和向量数据库。
负责过C端高并发系统的设计、开发和稳定性保障。
具备架构设计能力、抽象能力和平台化落地经验,有成功主导或深度参与中大型平台项目的证明,具备独立负责和推动复杂技术项目从设计到上线的全流程能力。
精通Java后端开发语言,具备深厚的编程功底和面向对象编程思想,熟练使用MySQL、Oracle等关系型数据库,具备数据库设计、优化和故障排查能力,熟悉实时数据处理技术栈,如Flink、Kafka等,有实时数据处理任务实战经验。
任职要求
(暂无)