角色扮演、代理行为及对抗博弈在 LLM 中的应用探索
Campus/Intern
Company Jd
Focus Tech · Algorithm
Location 北京
Published July 20, 2026
岗位职责
- 负责大语言模型(LLM)的底层训练与推理架构设计优化,持续迭代并调优模型训练的核心策略。
- 探索并应用强化学习与后训练前沿技术,大幅增强模型在角色扮演、复杂知识问答及高情商对话等场景下的拟真能力。
- 研发Agentic LLM与对抗博弈LLM创新架构,突破大模型自主决策与多智能体博弈的技术边界。
- 深度评测LLM领域最前沿技术(SOTA),精准评估其商业应用价值并高效推动工程化闭环落地。
任职要求
- 计算机、人工智能、自动化、数学或物理等相关领域的本硕博在校生。
- 具备扎实的LLM理论知识与工程实战经验,熟悉数据生成、清洗、SFT、DPO、RAG及推理加速等全链路技术。
- 具备卓越的动手能力与核心代码功底,能快速跟进并复现国际前沿论文算法并完成系统验证。
- 具备敏锐的技术洞察力与优秀的业务场景抽象能力。
- 拥有ACM等高水平编程竞赛获奖经历,在CCF A类顶会有论文发表,或曾主导开源过高影响力模型者优先。
部门/板块
京东科技