岗位描述
岗位描述:负责参与公司各类大模型(包括纯文本、代码、多模态等)的评测与优化,探索大模型时代前沿的评测、对齐与安全相关技术;设计并运行评估方案以衡量模型能力,编写高效清晰的代码构建评测流程;搭建针对文本、多模态、推理、Agent、Coding等不同能力的评估环境;参与模型自动评测整体架构设计与规划,持续优化现有系统性能和稳定性,编写清晰可维护的代码,并开展学术研究与论文撰写。 岗位要求:本科及以上学历,计算机科学或相关专业;在大模型训练、评测领域有一定研究经验;对新技术和趋势保持热情与好奇心,愿意持续学习和适应;具备良好的团队合作能力与沟通技巧。加分项包括:能够跳出常规思维,为范围不明确的问题找到解决方案;能够总结结果,在日常工作中发现问题并持续改进模型能力;有大模型评估经验或大模型系统搭建经验。