AI FinOps技术项目经理(TPM)
负责AI训练与推理业务的端到端成本管理,搭建全链路成本核算体系、成本模型及可视化Dashboard,实现多维度成本可视与对比;聚焦推理业务架构优化,识别资源瓶颈并推动降本方案落地,统筹额度分配、成本分摊与服务定价;跟踪训练任务资源利用率,推进闲置资源回收复用;结合业务趋势开展成本预测与预算规划,输出数据分析报告,支持预算、采购及技术选型决策;协同多技术团队评估成本影响,推动高ROI优化举措,建立成本管控机制。要求本科及以上学历,具备5年...
第 658 页,共 829 页
负责AI训练与推理业务的端到端成本管理,搭建全链路成本核算体系、成本模型及可视化Dashboard,实现多维度成本可视与对比;聚焦推理业务架构优化,识别资源瓶颈并推动降本方案落地,统筹额度分配、成本分摊与服务定价;跟踪训练任务资源利用率,推进闲置资源回收复用;结合业务趋势开展成本预测与预算规划,输出数据分析报告,支持预算、采购及技术选型决策;协同多技术团队评估成本影响,推动高ROI优化举措,建立成本管控机制。要求本科及以上学历,具备5年...
设计并实现基于大语言模型(LLM)的多模态Agent系统架构,支持多轮对话、工具调用、任务规划与执行;集成外部工具、API和Agent Skills(如搜索、数据库、代码执行等),扩展Agent能力边界;设计并实现Agent行为监控、效果评估与对齐机制,保障系统输出的稳定性、安全性与可控性;优化Agent系统的推理性能与并发处理能力,通过缓存、批处理、模型压缩与量化等手段提升效率并降低成本;与算法训练团队协作,系统化提升Agent成功率...
参与公司多芯片推理平台搭建;为各业务场景提供技术支持,推动同构融合计算技术在实际产品中的应用落地;与硬件、算法、方案团队紧密协作,共同解决技术难题,持续优化产品性能与效率。具体负责基于OpenMPI并结合公司芯片特点优化高性能通信库;负责在多die互联芯片平台上实现高效AI推理;基于对并行计算原理的深刻理解,参与AI CPU硬件架构升级,提升多芯片推理性能。要求具备计算机、电子工程及相关专业本科及以上学历,熟悉C/C++,熟悉CPU、G...
参与公司AI CPU(同构融合计算)芯片在计算领域的前沿研发,涵盖算子和框架的设计与开发;为各业务场景提供技术支持,推动同构融合计算技术在实际产品中的应用落地;与硬件、算法、方案团队紧密协作,共同解决技术难题,持续优化产品性能与效率。具体负责使用RISC-V指令集及AI指令集对相关算子库进行优化;基于对硬件指令、算子和模型的理解,优化模型精简算法,包括模型量化、模型剪枝等;基于对并行计算原理的深刻理解,参与AI CPU硬件架构升级。要求...
负责将亿级至十亿级参数的大模型(LLM、VLM、Audio LM)部署到终端芯片平台,并进行极致性能与能效优化,确保模型在资源受限环境下仍能提供流畅稳定的智能服务。主导vLLM、Ollama等框架在ARM CPU、NPU、GPU等异构平台上的移植、适配与深度优化,重点攻克注意力机制、KV Cache管理、解码策略在内存受限场景下的高效实现;针对终端特性优化或自研高性能、低内存占用的推理运行时,方向包括算子融合、计算图优化、静态内存规划、...