AI工程开发工程师(MJ030228)
Company 携程
Focus 技术 · 后端
Shanghai
August 28, 2025
岗位职责
-
参与大规模语言模型(LLM)及其他AI模型的在线服务部署、性能调优与推理加速,确保高并发、低延迟、高可用的模型服务。
-
参与设计和开发智能Agent运行框架,实现核心模块,包括不限于知识库存储与检索(RAG)、Agent的长短期记忆存储、对接多模型协作协议(如MCP/A2A)等新型交互机制。
-
负责搜索推荐算法工程后端系统的设计、开发和维护,保障系统稳定高效运行,实现高并发在线特征工程、模型推理服务集成和服务质量监控等核心模块。
-
参与系统架构的设计、优化及核心模块的代码实现(Java为主)。
-
与产品经理、算法工程师、前端工程师紧密协作,理解需求,设计技术方案并推动落地。
-
负责系统的日常维护、监控、故障排查和性能调优。
职位要求
-
具有算法平台开发或与算法团队深度合作经验者优先,特别是具备模型部署、模型在线推理服务的实际项目经验。
-
具备大语言模型或复杂模型在线部署(Triton, TorchServe, TensorFlow Serving)、性能调优和推理加速的实际项目经验者优先。
-
熟悉智能Agent系统核心模块(如知识库/RAG/工具调用/记忆管理)的设计或开发,熟悉相关框架(LangChain/LlamaIndex/MCP/A2A协议)和向量数据库。
-
必须负责过高并发C端系统的设计、开发和稳定性保障。
-
具备较强的架构设计能力、抽象能力和平台化落地能力。
-
必须精通Java后端开发语言,具备深厚的编程功底和面向对象编程思想。
-
熟练使用MySQL、Oracle等关系型数据库,具备数据库设计、优化和故障排查能力。
-
熟悉实时数据处理技术栈,如Flink、Kafka等,具有实时数据处理任务实战经验。