独角兽

语音大模型算法研究员

阶跃星辰

北京 / 上海 / 其他人工智能社会招聘

岗位描述

岗位描述:主导或深度参与语音多模态大模型的架构设计、训练、调优及迭代工作,提升模型整体性能,研究方向包括但不限于音频表征、音视频理解、语音生成、全双工语音对话、语音强化学习;跟踪学术界与工业界前沿技术动态,复现最新成果,推进技术迭代与创新突破;系统性设计并执行实验方案,深入分析模型表现,定位核心问题并提出有效优化与解决方案;参与团队合作,与团队一起解决技术难题,推动技术进展。 岗位要求:985/211 高校研究生及以上学历或优秀本科生,计算机、人工智能、软件、数学等相关专业;精通常用算法和数据结构,熟悉 Python 等编程语言,熟悉 Linux 平台;熟悉机器学习、深度学习,具备扎实算法基础,熟练使用 Pytorch、Megatron 深度学习框架;在语音多模态大模型某一领域(端到端语音、语音识别与理解、语音合成、Voice Agent)有深入研究经历;具备卓越的实验分析与问题解决能力,有创新思维与较强学习能力,能够良好沟通并与团队成员高效协作。加分项包括:在 ICASSP、Interspeech、ACL、ICML、NIPS、CVPR 等顶级学术会议发表过有影响力研究成果;在 ACM/ICPC、NOI/IOI、Kaggle 等编程或 AI 比赛获奖;主导或参与过 AI 相关且有较大影响力的开源或闭源项目。