解决方案架构师—CPU 与 LPU
岗位描述:负责推动下一代 AI 基础设施在 NVIDIA CPU 平台和基于 LPU 的推理系统中的应用,重点覆盖 NVIDIA CPU(包括 Grace、Vera 及未来 CPU 产品)以及用于加速大语言模型推理和其他低时延生成式 AI 负载的 LPU 平台与 LPX 级系统;作为 NVIDIA 与客户之间在 CPU/LPU 为核心的 AI 系统设计方面的一线技术专家,帮助客户理解 NVIDIA CPU 与 LPU 系统如何在异构生产...
第 253 页,共 835 页
岗位描述:负责推动下一代 AI 基础设施在 NVIDIA CPU 平台和基于 LPU 的推理系统中的应用,重点覆盖 NVIDIA CPU(包括 Grace、Vera 及未来 CPU 产品)以及用于加速大语言模型推理和其他低时延生成式 AI 负载的 LPU 平台与 LPX 级系统;作为 NVIDIA 与客户之间在 CPU/LPU 为核心的 AI 系统设计方面的一线技术专家,帮助客户理解 NVIDIA CPU 与 LPU 系统如何在异构生产...
岗位描述:负责通过与客户技术团队、本地现场团队及全球产品团队紧密合作,推动 NVIDIA 关键 AI 与加速计算库在多个行业中的落地与采用;跟踪并推动本地解决方案架构团队与全球产品团队的联合项目,确保职责归属清晰、里程碑明确、执行状态可跟踪,并将客户互动中的反馈有效传递到产品路线图决策中;深入理解客户工作负载与需求,并映射到 NVIDIA 各类库产品,识别功能、性能与易用性方面的差距;与 NVIDIA 产品和工程团队协作,通过功能需求、...
岗位描述:加入 Isaac Lab 团队,推动机器人学习平台发展,重塑自主系统训练方式并推动机器人与 AI 的未来。负责开发和扩展面向机器人学习的物理仿真 API,包括接触、关节、传感器和执行器模型;调试并解决复杂机器人系统中的仿真不稳定、非物理行为和确定性问题;作为用户和客户的主要技术联系人,处理来自 GitHub、外部合作伙伴和内部团队的问题分诊;将研究思路和物理模型转化为稳健、面向用户的 API;参与代码评审、系统设计讨论,并为内...
岗位描述:加入 Isaac Lab 团队,推动机器人学习平台持续升级,助力其成为行业领先工具,重塑自主系统训练方式并推动机器人与 AI 的未来发展。负责为大规模机器人仿真和学习系统设计、构建和维护 CI/CD 流水线、Docker 镜像和发布工作流;自动化工作流程,并在云端和本地环境中扩展仿真、训练和评估能力;开展大量 CPU/GPU 基准测试、性能分析和回归分析,确保系统性能、稳定性和可复现性达到最佳水平;负责系统级性能指标,如仿真步...
岗位描述:设计并原型化可扩展的软件系统,优化分布式 AI 训练与推理,重点关注吞吐、时延和内存效率。开发并评估 NCCL、UCX、UCC 等通信库增强能力,以满足深度学习工作负载的独特需求。与 TensorFlow、PyTorch、JAX 等 AI 框架团队协作,提升通信后端的集成性、性能与可靠性。参与 GPU、DPU 或互连等硬件特性的协同设计,加速数据传输并支持推理与模型服务的新能力。推动运行时系统、通信库及面向 AI 的协议层演进...
岗位描述:在售前阶段支持 Spectrum-X 等网络技术,与客户共同梳理并解决相关技术挑战和需求;为前沿创新技术开发概念验证材料,供早期采用者使用;建立客户信任并深入理解需求,帮助设计和部署用于 AI 与 HPC 工作负载的先进 NVIDIA 网络平台;处理复杂且高可见度的客户问题;与研发团队紧密合作,为客户推动新特性开发;协同工程和产品市场团队完善产品需求。 岗位要求:具备 8 年以上实时嵌入式计算机软件经验,熟悉 Linux 内核...
岗位描述:负责与NVIDIA软件、软件架构、售前团队以及业内领先架构和研发团队紧密协作,开发领先的软件解决方案与软件栈,为NVIDIA Connect-X网卡和BlueField DPU提供完整解决方案。深入了解NVIDIA重点客户的研发场景、应用需求及其对NVIDIA产品的使用方式。构建前沿POC原型,并推动其产品化和交付。与NVIDIA多个开发及架构团队密切合作,承担核心软件开发工作。 岗位要求:具备计算机科学、计算机工程或相关专业...