岗位描述
岗位描述:负责在 ROCm Execution Provider(EP)中深入开展 GPU 编译器与性能优化工作,通过 ONNX Runtime 让大语言模型和视觉模型运行在 AMD GPU 上;与核心团队协作,基于最新软硬件技术实现并优化 ONNX 算子的 MLIR lowering,支持更多 AMD GPU 目标平台;与 AMD 架构专家合作改进未来产品;采用数据驱动的方法缩小单算子相较竞品运行时的性能差距;持续跟踪软件与硬件趋势创新,尤其是算法与体系结构方向;设计并开发新的 AMD 前沿技术;参与新 ASIC 和硬件 bring-up;调试并修复现有问题,研究更高效的实现方式;与同事及合作伙伴建立技术合作关系。 岗位要求:热爱软件工程,具备推动复杂问题解决的能力;能够与 AMD 内部 GPU 编译器、MLIR 和内核团队高效沟通协作;具备扎实的面向对象编程基础,熟悉 C/C++ 优先;能够编写高质量代码并注重细节;具备 MLIR 或 LLVM 以及 GPU 或并行编程相关知识;熟悉 HIP/CUDA、ONNX/ONNX Runtime,以及性能分析与优化者优先;具备 Windows 和 Linux 开发经验,熟悉调试器、源码管理工具(如 GitHub)和性能分析工具;熟悉 AI 编码助手并愿意利用其提升效率者优先;具备英语工作能力、良好的沟通能力和问题解决能力;本科或硕士学历,计算机科学、计算机工程、电气工程或相关专业。