深度学习框架工程师/架构师
岗位描述:1. 基于壁仞GPU生态,设计和实现深度学习训练/推理框架的核心模块,分析并优化框架性能。2. 探索和研究框架前沿技术及发展方向,将新技术应用到壁仞GPU生态中,促进软件生态成熟。3. 解决日常测试中的框架相关问题,并协同上下游团队分析定位壁仞软件栈问题。 岗位要求:1. 计算机、自动化、模式识别、人工智能、电子信息等相关专业,具备5年以上深度学习领域工作经验。2. 具有良好的编程习惯与软件工程思维,有大型软件开发经验,熟练使...
第 146 页,共 829 页
岗位描述:1. 基于壁仞GPU生态,设计和实现深度学习训练/推理框架的核心模块,分析并优化框架性能。2. 探索和研究框架前沿技术及发展方向,将新技术应用到壁仞GPU生态中,促进软件生态成熟。3. 解决日常测试中的框架相关问题,并协同上下游团队分析定位壁仞软件栈问题。 岗位要求:1. 计算机、自动化、模式识别、人工智能、电子信息等相关专业,具备5年以上深度学习领域工作经验。2. 具有良好的编程习惯与软件工程思维,有大型软件开发经验,熟练使...
岗位描述:团队致力于开发原创性的通用计算体系,打造高性能大算力GPGPU产品,服务于人工智能产业以及AIGC、GPT等大模型应用,覆盖从架构设计到芯片研发、流片和软件落地的完整链路。1. 负责多卡互联相关模块设计,如南向互联、北向互联等。2. 编写微架构和设计文档。3. 编写相关RTL代码。4. 配合验证人员完成相关模块的功能和性能验证。5. 配合后端人员进行相关模块的PPA优化。6. 配合软件人员完成相关模块的使用与调试。 岗位要求:...
岗位描述:1. 能够独立完成Block和Chip Top物理实现与设计收敛工作,包括Floorplan、APR、Clocking等,并能够独立执行Timing ECO及时序收敛。2. 能够执行RC Extraction、STA、PV、EMIR等设计分析与收敛工作。3. 具备基本数字逻辑设计与可测性设计概念,能够与前端设计和DFT设计人员合作,持续优化设计PPA。4. 熟练掌握主流设计工具使用方法,深入理解物理设计流程,能够参与数字后端设...
岗位描述:1. 研究GPGPU及其集群中的性能场景,分析并定位软硬件性能瓶颈。2. 跟踪AI/HPC应用场景中的性能分析技术趋势,负责性能软件产品架构设计。3. 开发相关Benchmark、Profiler、性能模型、SDK等性能软件栈。4. 联合硬件架构师、框架团队、库函数团队等反馈性能问题,推动产品性能迭代。 岗位要求:1. 计算机科学、电子工程相关背景,深入理解计算机体系结构,思维敏捷,工程实践能力强。2. 具备扎实的C/C++/...
岗位描述:参与强化学习框架在国产芯片上的适配开发与优化;参与强化学习及其框架开源社区的推动和发展;参与基于国产芯片的强化学习相关项目落地与交付;跟踪前沿论文与开源方案,推动新方法在业务场景中落地。 岗位要求:具备扎实的机器学习、深度学习基础,理解策略梯度、Actor-Critic、价值函数等核心概念;熟练使用PyTorch,有RL或LLM训练的实际项目经验;熟悉至少一种强化学习框架,如Verl、Slime、Roll、AReal等;具备良...
岗位描述:参与芯片、封装应力分析和测试验证;负责扩展卡和模组板级热应力与机械应力仿真分析;负责板级可靠性验证和应力相关测试,并对应力仿真进行回归校验;参与扩展卡和模组结构设计与优化;为客户提供结构应力技术支持。 岗位要求:本科及以上学历,机械、力学、材料等相关专业,具有2-5年工作经验;了解电子产品应力仿真、验证测试和失效分析;了解FCBGA封装,有2.5D/3D先进封装相关经验者优先;熟悉Ansys Mechanical、Abaqus...
岗位描述:评估新产品封装需求,负责与封装厂的技术对接,完成新产品封装选型及封装方案可行性评估,兼顾产品设计需求和封装厂技术能力,制定具有竞争力的封装方案;负责与Interposer供应商对接,完成TO及相关工程问题协调解决;负责封装工程批次的进度管控、异常确认与问题解决,按期完成产品交付;与封装厂进行设计评审,审核并发布最终图纸及相关生产tooling确认;持续跟踪先进封装技术与新材料的行业进展,评估并导入新技术、新材料,提升产品竞争力...
岗位描述:负责主流大模型训练框架在壁仞芯片平台上的适配、功能验证、问题排查与性能调优;支撑预训练、微调等核心训练链路建设,落地MoE、多模态、智能驾驶等业务场景;定位并解决精度、显存、通信、算子等训练问题,搭建自动化工程体系;搭建自动化体系,借助AI Agent赋能适配工作与训练生态。 岗位要求:熟悉PyTorch核心训练流程与分布式并行策略(DP、TP、PP、ZeRO、FSDP等);掌握Megatron、DeepSpeed等一种或多种...
岗位描述:基于壁仞GPU软件栈,开发大模型和多模态大模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩等方向,持续优化大语言模型推理性能,降低模型推理延迟,提升线上模型服务吞吐。 岗位要求:硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业,具有3年及以上相关工作经历;具备扎实编程能力,熟练使用C/C++或Python;熟悉大模型推理技术栈,有vLLM、SGLang、LMDeploy、TensorRT-L...