岗位职责
- 思考当前大模型训练范式存在的不足,结合业界最新成果进行调研和实验,尝试提出自己的方法,在医疗场景验证方法的有效性;
- 进行自进化、持续学习算法和工程架构的设计、研发、以及与infra、environment等团队的协同推动方案的落地;
- 通过探索RSI、self-evolve、auto research等相关方向的技术,加速医疗智能的迭代效率,提升医疗大模型在long-horizon agentic task场景的效果。
任职要求
- 硕士及以上学历,计算机科学或相关专业背景;
- 具备大模型研发经验,在 RSI、self-evolve、auto research某一方向上有实践和积累;
- 算法与工程兼备,熟悉数据与训练策略,也了解主流训练和推理框架(如 Megatron、SGLang、vLLM等);
- 具有良好的学习和沟通能力,有好奇心和责任心,具有钻研精神,能够与算法团队、工程团队及其他技术团队紧密配合;
- 在大模型领域有科研或实践经验,在AI领域国际顶级会议/期刊发表过高质量论文优先;
- 具备算法和infra co-design经验, 对sglang/vllm/megatron有开发优化经验优先。
特色标签
Megatron-LM、Python、Reinforced Self-Improvement、SGLang推理框架、vLLM推理引擎、分布式训练、医疗、医疗AI Agent、医疗AI大模型、医疗智能体、医疗领域大模型、发表算法相关优秀论文、多模态算法、大模型算法、并行计算、强化学习、强化自改进、有留学背景、模型加速/性能优化、算法工程化经验、自动化研究、自动科研、自我进化、自然语言处理算法、自进化、长期智能体任务、长程智能体任务