独角兽

大模型训练优化算法实习生

智谱AI

地点待补充算法社会招聘

岗位描述

岗位描述:负责大语言模型(LLM)及多模态大模型在科研场景下的全生命周期落地,包括数据构建、后训练、推理部署及效果评测;深入理解数学、物理、化学、生物、电气电子工程等科研领域需求,设计并实现基于LLM的解决方案,解决科研过程中的复杂问题;利用机器学习算法对各领域科研数据进行挖掘分析,构建并优化基线模型,为LLM应用提供数据与算法支撑;独立完成科研数据的清洗、存储与维护工作,熟练使用SQL、Hive等工具进行大数据处理,构建高质量训练数据集;跟踪学术界与工业界前沿技术,调研相关领域SOTA方案,并与科研人员紧密协作,推动算法模型在实际项目中的落地与迭代。岗位强调完整参与真实项目,希望实习生能长期稳定实习并深耕业务。 岗位要求:深刻理解Transformer架构,熟悉主流大语言模型及多模态模型架构;具备扎实的后训练落地经验,精通SFT、PEFT(如LoRA、P-Tuning)及RL(如DPO、PPO、GRPO)的技术细节与工程实现;熟悉大模型推理优化技术及自动化评测体系,能独立搭建从数据处理、多机多卡训练到模型评测的完整闭环流程;具备扎实的机器学习理论基础,熟练掌握回归、分类、聚类、关联分析等经典算法,能够独立完成数据挖掘任务并针对特定领域数据进行特征工程与基线建模,有Kaggle、天池等竞赛获奖经历者优先;熟练掌握SQL、Redis、Hadoop、Hive、Spark等常用数据库及大数据处理工具,能够独立完成数据ETL流程、数据仓库维护及高性能数据读取管道搭建;具备优秀的数理基础、快速学习能力与跨学科理解能力,能够快速掌握数学、物理、化学、生物、电气电子工程等专业知识;具备优秀的中英文文献阅读与调研能力,能独立完成前沿技术方案调研与复现;具备良好的沟通协作能力与项目管理意识,能够独立推进项目进度、协调资源并确保高质量交付;编程基础扎实,熟练掌握Python等编程语言,代码风格良好。加分项包括:在顶会发表过LLM或AI for Science相关论文;有知名开源项目贡献或维护经验;具有计算机与物理、生物、化学等跨学科背景;有完整科研智能化项目落地经验。岗位更期待可稳定实习12个月以上。