职位列表
第 80 页,共 415 页
LLVM编译器工程师
岗位描述:支持自研 GPU 在 AI 和大模型场景下的编译优化与性能提升;负责面向自研 GPU 的编译优化方案与算法设计和开发;负责制定并实施自研 GPU 计算核部分的基准性能评估与编译优化性能评估方案;参与未来自研 GPU 处理器指令集和微架构设计,演进编译器优化能力以支持新特性。 岗位要求:计算机软件或相关专业硕士及以上学历,精通 C/C++ 编程,熟悉计算机体系结构和编译原理;具备良好的沟通能力和代码习惯,熟悉 Linux 开发调...
GPU互联软件工程师
岗位描述:设计、开发和调试支持多 GPU 的驱动程序和软件;与其他软件工程师共同完成驱动和支撑软件的设计与开发,提供对多 GPU(南向互联和北向互联)的支持;与软硬件工程师协调解决软硬件架构问题,为下一代芯片提供高性能、低延迟、高可靠性的大集群软件解决方案;协助客户平台的多 GPU 方案落地,并根据用户需求完善整体平台端到端软件方案;与其他软硬件工程师协同,解决多 GPU 平台中的问题并优化系统性能。 岗位要求:具备交换机、路由器、大集...
GPGPU IO库开发工程师
岗位描述:负责 GPU/NPU 控制各类外设(如 RNIC 等)相关的 IO 库开发工作。 岗位要求:熟悉计算机体系结构及操作系统原理;熟练掌握 C/C++ 编程;熟悉 Linux 环境编程。加分项包括:理解异构计算驱动工作原理,如 OpenCL、CUDA 等;了解 RDMA 工作原理,有相关应用开发经验,或阅读过 RNIC 驱动代码;了解 MPI、NVSHMEM、NCCL 等任一分布式编程模型;了解 NVIDIA GPUDirect...
AI编译器架构工程师(Kernel生成方向)
岗位描述:针对自研架构设计和优化 Kernel 综合器,支持硬件架构验证及高性能算子交付;负责核心基础设施的维护与演进,包括多层 IR 及 Lower 过程、编程范式抽象、面向 Tensor 的抽象、ISA 层抽象;负责关键 Pass 的设计与优化,如生命周期/活跃性分析、资源分配、Peephole 优化;建设与维护回归体系,包括单元测试、集成测试、CI 稳定性、代码规范与静态检查;与硬件团队协同设计,反馈自研指令集在性能与易用性方面的...
AI编译器开发工程师
岗位描述:负责 AI 编译器的设计与实现;开展 AI 模型性能分析与优化,定位性能瓶颈并改进编译优化算法;解决 AI 模型的编译和部署问题;负责算子适配与调优;承担软件质量维护与功能扩展工作。 岗位要求:具备 XLA、MLIR、TVM、TRITON 等项目中的一个或多个实践经验;熟练使用 C/C++,熟悉常用数据结构和算法,具备良好的编程习惯和代码风格;具备深度学习算法相关知识;计算机、自动化、微电子等相关专业背景;以上要求至少满足两条...
高性能分布式存储工程师
岗位描述:在 AGI 浪潮中,致力于打造大模型时代的极致数据底座,通过软硬协同的底层突破,将存储转化为决定 AI 成本与体验的核心竞争力,让每一次推理与训练都更快且更具成本优势。负责研发面向大模型推理服务的高性能 KVCache 存储系统,解决在上下文长度海量增长和推理并发请求数提升场景下的成本与性能问题;深度配合推理业务,在存储架构与推理业务之间寻找最佳协同设计,持续优化并支撑模型推理对存储的需求;深度应用各类高性能技术,挑战硬件物理...
高级算法系统工程师
岗位描述:参与 Kimi 跨模态通用模型开发,设计并构建高效的数据流转、训练和测试系统,通过合理的工程化与系统抽象大幅加速研发过程;基于对深度学习的扎实理解,发掘研发过程中呈现的共性模式,通过合理抽象与良好设计构建便捷、鲁棒、可复用的 library 和 service。 岗位要求:计算机科学或相关领域本科及以上学历;对机器学习或大模型底层原理有扎实理解,具备大模型训练、计算机视觉或强化学习相关方向的工程经验;熟悉 Python 和 C...