岗位描述
岗位描述:负责语音大模型 Agent 能力建设,包括实时语音交互、多轮对话、任务执行与工具调用能力研发;参与 ASR、TTS、语音理解、语音智能体(Voice Agent)等核心能力的工程化落地;构建面向企业场景的语音 Agent 工作流、Prompt、记忆与规划能力;负责语音模型服务优化,包括低延迟推理、流式交互、实时中断等关键技术;与算法、产品、行业团队协同,推动智能客服、数字人、语音助手等场景落地。 岗位要求:本科及以上学历,计算机、人工智能相关专业;熟悉 Python、Golang、C++ 至少一种开发语言;熟悉 LLM Agent、Function Calling、Workflow、RAG 等技术体系;了解 ASR、TTS、语音大模型或实时音视频技术者优先;具备较强的工程能力与复杂系统设计能力;有智能客服、数字人、座舱语音等项目经验者优先。