职位列表
第 16 页,共 21 页
AI基础设施工程师
专注于大语言模型和多模态模型在端侧或服务器端的量化与推理性能优化,围绕模型结构与数值特性设计稳定、可复现的量化方案,增强对不同模型结构的通用性;负责大模型与多模态模型的量化方案设计与实现;推进权重量化、激活量化及混合精度策略的工程化落地;分析和处理量化过程中的异常值,并评估其对精度的影响与策略选择;负责 KV Cache、Attention、FFN 等核心模块的量化与验证;完成量化模型在主流推理框架中的部署与问题排查;跟进主流模型架构与...
高性能计算工程师-集群分布式计算
参与公司多芯片推理平台搭建;为各业务场景提供技术支持,推动同构融合计算技术在实际产品中的应用落地;与硬件、算法、方案团队紧密协作,共同解决技术难题,持续优化产品性能与效率。具体负责基于OpenMPI并结合公司芯片特点优化高性能通信库;负责在多die互联芯片平台上实现高效AI推理;基于对并行计算原理的深刻理解,参与AI CPU硬件架构升级,提升多芯片推理性能。要求具备计算机、电子工程及相关专业本科及以上学历,熟悉C/C++,熟悉CPU、G...
高性能计算工程师-算子优化
参与公司AI CPU(同构融合计算)芯片在计算领域的前沿研发,涵盖算子和框架的设计与开发;为各业务场景提供技术支持,推动同构融合计算技术在实际产品中的应用落地;与硬件、算法、方案团队紧密协作,共同解决技术难题,持续优化产品性能与效率。具体负责使用RISC-V指令集及AI指令集对相关算子库进行优化;基于对硬件指令、算子和模型的理解,优化模型精简算法,包括模型量化、模型剪枝等;基于对并行计算原理的深刻理解,参与AI CPU硬件架构升级。要求...
边端侧大模型推理框架部署优化高级工程师
负责将亿级至十亿级参数的大模型(LLM、VLM、Audio LM)部署到终端芯片平台,并进行极致性能与能效优化,确保模型在资源受限环境下仍能提供流畅稳定的智能服务。主导vLLM、Ollama等框架在ARM CPU、NPU、GPU等异构平台上的移植、适配与深度优化,重点攻克注意力机制、KV Cache管理、解码策略在内存受限场景下的高效实现;针对终端特性优化或自研高性能、低内存占用的推理运行时,方向包括算子融合、计算图优化、静态内存规划、...
财务经理/财务主管
牵头搭建与完善公司收入核算体系、成本核算体系,制定标准化核算流程与内控节点,确保核算真实、准确、可追溯;梳理并优化财务业务流程,主导财务规范整改与内控体系建设,提升整体财务治理水平;对接外部审计及专业机构,负责资料统筹、问题沟通与整改落地;主导ERP财务模块的需求梳理、流程设计与上线落地,推动财务核算系统化、标准化;开展预算管理、经营分析、成本管控与资金统筹,协同业务部门提升运营效率。要求本科及以上学历,财务、会计、审计相关专业,CPA...
AI集群架构芯片架构师
与一流芯片架构和设计团队共同开展高端芯片架构研发,主导AI芯片集群系统构建。负责解析市场需求,形成高性能AI芯片需求包和技术规格;参与从应用场景分析、产品定义、芯片开发到AI芯片集群方案落地的全过程;负责芯片架构设计、性能分析、低功耗设计以及服务器芯片顶层架构和微架构设计;负责核心AI系统架构前瞻性需求调研、分析和设计,对系统前瞻性能力负责;负责核心AI系统分布式架构设计及相关模块研发,满足可扩展性、高可用性和高性能要求;主导重大技术难...