职位列表
第 63 页,共 267 页
高级 HPC 与 AI 网络性能研究分析工程师
岗位描述:加入 NVIDIA 性能团队,负责在大规模 GPU 与 CPU 集群上对 AI 工作负载进行性能画像与分析,重点关注分布式深度学习、LLM 训练与推理中的通信模式、集合通信、RDMA、网络与系统性能;接触并协同多种硬件平台与软件层,包括 HCA、交换机、CPU、GPU、整机系统及相关软件功能;使用模拟器并开发性能分析工具与方法,深入研究性能预期、限制与瓶颈,并开展根因分析;面向 NVIDIA 超级计算机环境研究适用于大规模深度...
网络解决方案测试工程师(AI InfiniBand与以太网集群调试)
岗位描述:加入端到端验证团队,负责面向前沿以太网 AI 集群的系统级测试与调试工作,处理跨硬件、系统软件和 AI 工作负载的复杂问题;设计并评审 InfiniBand、以太网、网卡、DPU、交换机产品组合中的测试与产品需求,重点关注大规模 AI 集群行为;搭建并维护贴近真实客户环境的测试平台,包括异构硬件、操作系统/驱动组合及复杂网络结构;负责端到端集群故障排查,复现客户场景,进行全栈问题分流并推动定位根因与修复;阅读并理解相关源码以定...
HPC 与 AI 集群工程师
岗位描述:加入 Networking clusters solutions HPC/AI Infrastructure 团队,参与基于前沿技术构建超级计算机和 AI 集群,面向人工智能与 GPU 计算领域的最新突破,成为集群工程关键成员。你将使用最新的加速计算和深度学习软硬件平台,与科研人员、开发者和客户合作,打造更优工作流并开发新的差异化解决方案;与 HPC、操作系统、GPU 计算及系统专家协作,架构设计、开发并完成大规模高性能平台的...
GPU 计算工程师(自动驾驶)
岗位描述:面向自动驾驶场景,分析深度学习模型,定位并研究客户或内部团队反馈的 TensorRT 稳定性和性能问题。与美国、亚太和印度等跨区域团队协作,参与 CUDA 和 TensorRT 相关开发工作。结合分析和开发过程提炼功能需求或常见问题,并形成相应文档。 岗位要求:具备计算机科学或电子工程相关专业本科及以上学历,硕士优先,或具备同等经验。具有 3-5 年以上相关工作经验。具备扎实的 C、C++ 和 Python 编程能力。了解主流...