GPU 性能分析软件工程师
岗位描述:作为 GPU Foundations Developer Tools 团队成员,参与底层库开发,帮助开发者使用工具对其系统和应用进行调试、性能分析与诊断;围绕 NVIDIA 硬件性能分析能力以及 Nsight 工具和基础库进行创新开发,支持下一代数据中心规模的加速计算。与跨职能团队合作,为 NVIDIA GPU 设计、实现并验证性能指标;开发并改进 GPU 性能分析数据采集方法;定义、发明并增强 GPU Profiling 库...
第 252 页,共 835 页
岗位描述:作为 GPU Foundations Developer Tools 团队成员,参与底层库开发,帮助开发者使用工具对其系统和应用进行调试、性能分析与诊断;围绕 NVIDIA 硬件性能分析能力以及 Nsight 工具和基础库进行创新开发,支持下一代数据中心规模的加速计算。与跨职能团队合作,为 NVIDIA GPU 设计、实现并验证性能指标;开发并改进 GPU 性能分析数据采集方法;定义、发明并增强 GPU Profiling 库...
岗位描述:面向芯片设计与自动化基础设施,创新、开发并集成AI解决方案,重构围绕AI构建的芯片工具链。负责设计和实现基于AI/LLM的系统,提升半导体验证环境中的硅后验证、自动化和工作流效率;与跨职能工程团队合作,识别AI集成和性能优化机会;评估新兴框架、架构与工具,推动全组织范围内由人工智能驱动的效率提升;建立并维护数据驱动指标,用于量化AI影响、识别性能差距并推动系统持续优化。从概念到部署全程推动方案落地,提升工作流的效率、可扩展性和...
岗位描述:负责开发 NVIDIA 关键的开发工具与建模环境,参与高层芯片模型、测试 API、追踪生成流程和分析工具的研发。作为软件开发团队成员,负责构建并改进核心基础设施,用于大规模通用图形与计算芯片开发过程中的执行、自动化和调试,支持驱动栈、应用、测试与研究在各类功能、诊断和性能模型上无缝运行。具体包括:在 GPU 开发的各个阶段发挥关键作用;改进顶级芯片建模与设计人员的日常工作流,助力打造下一代 GPU;帮助 GPU 架构师理解当前...
岗位描述:作为 AI Networking Research 团队的架构师,探索加速网络与 AI 数据中心建设中的技术挑战,开发和研究新的传输功能与语义,以优化 AI 工作负载、AI 系统通信及加速能力。参与现代 AI 数据中心多个技术领域的架构与开发工作,包括分布式 AI、深度学习解决方案、数据分析、高性能计算(HPC)、软件定义网络(SDN)、虚拟化、存储等。具体包括:增强 NVIDIA 面向 AI 工作负载加速的 GPU 网络产品...
岗位描述:负责面向云服务商客户推动生成式 AI 相关解决方案落地,重点涉及大语言模型、生成式 AI、智能体 AI 或推荐系统;与客户建立长期技术合作关系,提升客户生产力,使 NVIDIA 技术成为终端解决方案的重要组成部分;在快节奏、快速演进的 AI 领域中,与企业市场、行业商务拓展及工程团队协同推进工作;作为 NVIDIA 与客户之间的一线技术专家,工作内容包括 PoC 演示、面向关键高管和管理者推广加速计算,并与开发者、科研人员、数...
岗位描述:跟进并推动自动驾驶、机器人、工业自动化等领域的物理 AI 项目落地,与客户技术团队、本地现场团队以及全球产品团队紧密协作。作为本地客户项目与 NVIDIA 产品组织之间的技术产品管理接口,确保项目状态、里程碑、阻塞问题和后续计划具备清晰可见性。协调本地解决方案架构团队、客户、合作伙伴及全球产品/工程团队之间的联合项目,确保需求被充分记录,并对交付进度进行持续跟踪。深入理解客户在仿真、合成数据生成、机器人学习、数字孪生、具身 A...