强化学习算法工程师
负责算法研究与开发,深入研究强化学习前沿算法(如PPO、GRPO等)并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;推动强化学习在大规模场景中的应用,提升模型长思考能力、通用能力和Agent能力。要求具备计算机科学、人工智能、机器学习、数学、统计学或相关领域硕士及以上学历,熟悉强化学习经典算法并具备实际项目经验,熟悉TensorFlow、PyTorch及常见强化学习训练框架,了解大规模分布式训练,具备扎实的Python编...
第 117 页,共 161 页
负责算法研究与开发,深入研究强化学习前沿算法(如PPO、GRPO等)并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;推动强化学习在大规模场景中的应用,提升模型长思考能力、通用能力和Agent能力。要求具备计算机科学、人工智能、机器学习、数学、统计学或相关领域硕士及以上学历,熟悉强化学习经典算法并具备实际项目经验,熟悉TensorFlow、PyTorch及常见强化学习训练框架,了解大规模分布式训练,具备扎实的Python编...
负责法律行业大模型商业化项目全生命周期管理,统筹项目从启动、规划、执行到交付的全流程,确保按照时间节点、质量标准及预算要求落地交付,保障客户满意度。制定详细项目计划,跟踪项目进度,及时识别并解决项目执行中的风险与瓶颈,协调内外部资源,保障项目高效推进。联动销售、市场、客户支持等团队,结合法律行业场景需求制定商业化推广策略,推动大模型产品在司法、律所、企业法务等细分市场的落地推广与规模化拓展。持续收集市场反馈、客户需求及行业动态,推动产品...
负责公司大模型训练引擎研发,将算法逻辑高效转化为大规模分布式系统实现,重点聚焦训练底座的深度定制与性能优化。在千卡或万卡规模集群上,针对 NVIDIA H 系列或国产算力优化 NCCL/HCCL 通信策略,提升集群 MFU。深度调优 3D 并行(TP/PP/DP),并引入序列并行、上下文并行等技术,解决超长文本训练中的系统工程瓶颈。利用 Triton 或 CUDA 提升核心算子效率,推动 FP8 混合精度训练及 Transformer...
负责端侧大模型在办公、具身智能、医疗、遥感、思维博弈、电磁信号等垂直领域的解决方案设计;具备大模型预训练、微调等基础知识,能够根据客户需求完成模型选型、数据策略制定及微调方案设计。熟练运用 Vibe Coding 等高效编码方式,快速生成、迭代和调试代码原型,缩短从需求到可运行方案的验证周期,支撑解决方案快速交付与演示。承担项目全流程管理职责,包括立项、需求分析、进度计划、资源协调、风险控制、交付验收等,确保项目按时、按质、按预算完成,...