蚂蚁技术研究院长期研究型实习生-大模型算法
Campus/Intern
Company Antgroup
Focus Tech · Algorithm
Location 北京, 上海, 杭州
Published February 20, 2025
岗位职责
职位描述: 参与大模型的前沿研究工作。你将与顶尖的研究团队合作,探索数据在大模型训练、优化和应用中的核心作用,推动大模型数据智能领域的创新。
研究内容: 1.研究和实践创新的数据生成策略,为模型打造高质量、高信息量的人类偏好数据集 2.迭代和优化 Critic Model,设计有引导性的评估规则,使其能够对模型输出进行自动化、高质量的打分 3.搭建和维护贯穿训练全过程的持续评估系统,实时监控模型的价值对齐、输出风格及其他关键性能指标,确保模型行为符合预期
任职要求
- 学历背景:计算机科学、人工智能、数据科学、数学等相关专业的硕士或博士在读学生。
- 技术能力:
- 精通Python编程,具备扎实的算法、数据结构和机器学习基础。
- 精通深度学习和大模型框架(如PyTorch、Huggingface transformer、LangChain、vLLM、DeepSpeed、Megatron-LM等)。
- 了解大模型的基本原理、训练和评估流程。
- 研究经验:
- 有大模型合成数据相关研究经验者优先。
- 有处理和分析人类偏好数据的经验者
- 对大模型安全、可解释性或伦理有深入研究者
- 论文阅读与实现能力:能够快速阅读和理解顶级会议(如NeurIPS、ICLR、ICML、ACL等)的论文,并复现算法。
- 学习与创新能力:对前沿技术有强烈兴趣,具备独立思考和解决问题的能力。
- 团队合作:良好的沟通能力和团队协作精神,能够与团队成员高效合作。
- 加分项:
- 在顶级会议或期刊发表过相关论文者优先。
- 有分布式数据处理框架(如Ray、Spark)使用经验者优先。
特色标签
Hugging Face模型、LLM、Python、Transformers库、人工数据、偏好数据集、分布式计算框架、分布式训练、发表算法相关优秀论文、变形金刚大规模语言模型推理框架、合成数据、大数据、大语言模型、批判模型、持续评价系统、数据挖掘、智能研发、模型加速/性能优化、深度学习框架、用户偏好数据、神经网络框架、自动评估系统、自然语言处理算法、评估模型、语言模型链式框架