深度学习性能架构师(CUTLASS DSL 测试)
岗位描述:负责开发和持续演进 NVIDIA CUTLASS DSL 测试框架,面向下一代 GPU 软件构建高质量测试体系;制定、完善并执行面向开源社区发布的产品测试策略;保障基于 MLIR 的编译流水线及相关功能覆盖基础设施的端到端代码质量;构建可规模化的自动化测试、代码覆盖率度量与回归检测流程;与多个团队协作,确保每一次算子改动都满足正确性、质量与性能的高标准,并让产品随时具备可发布状态。 岗位要求:计算机科学、软件工程或相关专业硕士...
第 47 页,共 140 页
岗位描述:负责开发和持续演进 NVIDIA CUTLASS DSL 测试框架,面向下一代 GPU 软件构建高质量测试体系;制定、完善并执行面向开源社区发布的产品测试策略;保障基于 MLIR 的编译流水线及相关功能覆盖基础设施的端到端代码质量;构建可规模化的自动化测试、代码覆盖率度量与回归检测流程;与多个团队协作,确保每一次算子改动都满足正确性、质量与性能的高标准,并让产品随时具备可发布状态。 岗位要求:计算机科学、软件工程或相关专业硕士...
岗位描述:围绕NVIDIA芯片产品化流程中的硅层行为工具链,使用AI重构仿真、配置和数据流系统,使芯片的功耗、性能和良率从前仿真估计顺利过渡到固件发布值与客户规格。负责建设基础设施,将原始仿真数据(如功耗、噪声、分档良率等)转化为实际的固件调优、产品规格和制造限制,打通各工具之间的数据管道。利用LLM和代理技术,对分析、验证和报告工作进行自动化,减少每颗芯片大量工程投入。建设可观测性与验证系统,在数据错误和不一致转化为发布阻塞问题前及时...
岗位描述:作为 GPU Foundations Developer Tools 团队成员,参与底层库开发,帮助开发者使用工具对其系统和应用进行调试、性能分析与诊断;围绕 NVIDIA 硬件性能分析能力以及 Nsight 工具和基础库进行创新开发,支持下一代数据中心规模的加速计算。与跨职能团队合作,为 NVIDIA GPU 设计、实现并验证性能指标;开发并改进 GPU 性能分析数据采集方法;定义、发明并增强 GPU Profiling 库...
岗位描述:负责面向云服务商客户推动生成式 AI 相关解决方案落地,重点涉及大语言模型、生成式 AI、智能体 AI 或推荐系统;与客户建立长期技术合作关系,提升客户生产力,使 NVIDIA 技术成为终端解决方案的重要组成部分;在快节奏、快速演进的 AI 领域中,与企业市场、行业商务拓展及工程团队协同推进工作;作为 NVIDIA 与客户之间的一线技术专家,工作内容包括 PoC 演示、面向关键高管和管理者推广加速计算,并与开发者、科研人员、数...
岗位描述:加入Isaac Lab团队,推动机器人学习旗舰平台的发展,致力于将其打造为行业领先工具,重塑自主系统训练方式并推动机器人与AI未来发展。负责开发平台新特性,包括感知闭环强化学习、多智能体与多任务学习、VLA与强化学习集成等。推进工作流自动化并在云端实现大规模扩展,开展广泛的基准测试与性能分析,确保系统性能与可扩展性达到行业领先水平。与NVIDIA内部研究和工程团队(如DEX、GEAR)紧密合作,支持下一代人形机器人及仿真到现实...