Agent基建工程师
岗位描述:负责Agent训练与推理全链路框架的开发、优化与稳定性保障,支撑大规模模型训练实验高效运转;设计并维护Agent执行沙箱,保障代码执行、工具调用等复杂场景下的安全性、隔离性与可靠性;构建支撑Post-Train团队日常实验的基础平台,涵盖实验管理、数据流水线、评测对比等核心能力。 岗位要求:具备独立思考能力,有自己的判断,不盲从权威,敢于表达观点;有真实生产或实验环境项目维护经验,经历过问题排查、Bug修复和系统重构,重视代码...
第 28 页,共 829 页
岗位描述:负责Agent训练与推理全链路框架的开发、优化与稳定性保障,支撑大规模模型训练实验高效运转;设计并维护Agent执行沙箱,保障代码执行、工具调用等复杂场景下的安全性、隔离性与可靠性;构建支撑Post-Train团队日常实验的基础平台,涵盖实验管理、数据流水线、评测对比等核心能力。 岗位要求:具备独立思考能力,有自己的判断,不盲从权威,敢于表达观点;有真实生产或实验环境项目维护经验,经历过问题排查、Bug修复和系统重构,重视代码...
岗位描述:负责 Agentic RL 训练基础设施建设,覆盖 Sandbox、Environment Runtime、Scaffold、多阶段 RL Workflow、Eval 与 Replay 等核心链路。支持大规模 Environment 生产、数据回流与训练闭环,持续优化系统稳定性、吞吐与可扩展性。与算法、数据、Infra 团队深度协同,推动复杂 Agent 任务训练体系的工程化落地。 岗位要求:具备扎实的工程能力,熟悉 Pyth...
岗位描述:负责StepFun开放平台的产品营销与商业增长,将模型能力转化为市场语言,通过渠道网络和营销动作提升调用量和收入,并对增长KPI结果负责;定义目标客群与优先场景,如Coding、Agent等,建立面向开发者的价值主张、差异化卖点与可复述的产品叙事;开拓并维护中间件平台、开发工具、云市场、代理商等渠道合作网络,推动StepFun成为生态默认选项;负责GTM策划与执行,操盘重点场景的上市节奏,包括定价策略、套餐设计、促销方案与发布...
岗位描述:跟踪并分析国内主流大模型的最新进展,包括模型架构、性能指标和应用场景等;与客户及内部团队紧密合作,深入理解各行业对AI技术,尤其是大模型和高性能计算的需求;基于“国模+国芯”技术栈,设计并优化适用于特定行业的解决方案架构,确保方案具备可行性、可扩展性和高性能;根据项目需求选择合适的国产大模型和GPU服务器,确保技术方案最佳匹配;与技术团队协作推进方案实施,包括模型部署、系统集成和性能优化,并为项目团队提供技术指导与支持,解决实...
岗位描述:深度参与语音模型的数据全链路工作,围绕语音模型能力提升及业务场景落地,与算法、研发、产品、数据基地紧密合作,深入理解模型训练及评测需求,提供数据采集、标注、评测、数据构建等专业数据解决方案,助力语音基座模型能力持续提升。结合语音语言学特点及模型发展需求,负责语音数据标准、标注规范、质量评价体系的设计与优化,探索高效的数据生产及评测方法,推动数据质量提升和模型效果优化。深入分析语音交互、语音合成、语音识别等场景中的数据问题,基于...
岗位描述:作为算法需求与外部数据供给之间的前置策略角色,对接算法、训练、评测、产品等团队,理解预训练、SFT、偏好数据、RL、Agentic RL、评测集、轨迹数据、垂类专家数据等不同阶段的数据需求,并将相对模糊的算法需求拆解为可执行的数据建设方案,明确数据类型、样本结构、规模预估、难度分层、覆盖维度、交付格式、质量标准和验收方式。负责数据资源从0到1的端到端推进,包括需求确认、市场调研、资源寻源、供应商沟通、样例收集、试单设计、报价比...
岗位描述:研发适用于视觉生成任务的文生图基座大模型和图像编辑大模型后训练算法 RLHF,推动模型效果显著超越 Stable Diffusion、Flux 以及 QWen-image 等开源基座模型。负责 RLHF 奖赏模型设计,以数据驱动方式从美学评分、指令遵循、文字渲染、肢体优化等多个维度设计并研发 reward model,提升并激发生成模型后训练上限。开展 RLHF 强化学习算法研发,基于 Diffusion/AR generat...
岗位描述:构建成本可见性体系,建立优化机制,推动跨团队降本增效,直接影响公司 AI 业务的财务健康度与资源效率。负责 AI 训练与推理业务的端到端成本管理,搭建全链路成本核算体系、成本模型及可视化 Dashboard,实现多维度成本可视与对比。聚焦推理业务架构优化,识别资源瓶颈,落地降本方案,统筹额度分配、成本分摊与服务定价。跟踪训练任务资源利用率,推进闲置资源回收复用。结合业务趋势开展成本预测与预算规划,输出数据分析报告,支撑管理层预...