独角兽

语音大模型评测工程师

阶跃星辰

北京 / 上海 / 其他人工智能社会招聘

岗位描述

岗位描述:负责语音大模型的评测体系建设,设计并实现多维度评测框架,使模型能力可衡量、可对比、可解释。结合业务与模型目标,构建并维护评测集与 Benchmark,持续跟踪模型效果变化,推动模型能力优化。持续跟踪语音大模型及多模态领域的前沿论文与开源社区进展,将新的数据构建策略、评测方法快速落地到实际业务中。以产品化和结果导向的视角发现问题,基于数据与评测结果推动算法与模型能力的持续提升。 岗位要求:本科及以上学历,计算机、人工智能、电子信息或相关专业。熟练使用 Python、Go、Java、C++ 中至少一门语言,具备独立编写脚本、调用 API、构建评测工具的能力。在语音算法方向有较深入的实践经验,对大模型有基础认知,使用过主流大语言模型,能够快速理解 SFT、RLHF / RL 等核心概念。有参与大模型 Benchmark、Evaluation、数据集构建相关工作的经验者优先。