CTO-大模型-训练技术
Campus/Intern
Company Antgroup
Focus Tech · Algorithm
Location 北京, 上海, 杭州, 成都
Published April 23, 2026
岗位职责
大模型作为人工智能领域的重要突破,其训练技术决定了模型对语言和多模态的理解与生成能力。大模型训练涉及海量数据的高效处理、知识的学习与存储、指令遵循和推理能力的激发,如何在有限资源下优化训练效率、提升模型对特定领域的适配能力,仍是一个关键挑战。本项目旨在:
- 探索更加高效的训练技术与算法创新;
- 解决当前大模型在效率、泛化性和领域适配性上的问题;
- 推动其在工业和学术领域的进一步发展。
任职要求
- 目前正在攻读计算机科学或相关STEM领域的学士,硕士或博士学位;
- 具有一种或多种通用编程语言的经验,包括但不限于: Java,C/C ++ 、Python、JavaScript或Go;
- 具有上述研究领域的相关经验,包括行业经验或作为参与实验室研究。
优先录用:
- 对技术研究充满热情,具有产生新思想和创新的能力; 在自学,问题分析和解决方面表现出色;
- 在国际会议上或核心期刊发表一份或多份出版物或论文;
- 至少3个月的全职工作。
特色标签
C/C++、Golang、Java、Python、云原生、分布式计算、发表算法相关优秀论文、图文语音融合、垂直领域微调、基础设施、多模态学习、多模态算法、大型预训练模型、大模型算法、大规模数据、大规模神经网络、大语言模型、巨量语料、常识推理、强化学习、指令对齐、指令理解、指令调优、新训练范式、智能研发、有留学背景、机器学习、模型加速/性能优化、模型训练算法、深度学习、知识注入、知识表示、知识记忆、研发效能、算法工程化经验、算法突破、算法革新、自然语言处理算法、行业定制、计算效率、训练优化策略、训练加速、资源利用率提升、超大数据集、跨模态理解、逻辑推理、链式推理、领域特化、高效训练方法