端侧大模型压缩算法工程师
负责端侧大模型在手机、驾舱及智能硬件等终端的压缩部署;开展端侧大模型前沿压缩算法研究,推动剪枝、量化、蒸馏、稀疏化等技术的创新与应用;探索并攻关端侧大模型低精度训练技术,从训练阶段提升模型对低精度计算的适应性;研究与设计硬件友好的低精度量化算法,协同底层算子团队实现异构硬件上的极致性能优化。要求精通模型压缩理论,深入理解剪枝、量化、知识蒸馏、稀疏化、低秩分解等技术的数学原理与工程权衡;具备大模型量化研究与工程经验,熟悉 SmoothQu...
第 328 页,共 415 页
负责端侧大模型在手机、驾舱及智能硬件等终端的压缩部署;开展端侧大模型前沿压缩算法研究,推动剪枝、量化、蒸馏、稀疏化等技术的创新与应用;探索并攻关端侧大模型低精度训练技术,从训练阶段提升模型对低精度计算的适应性;研究与设计硬件友好的低精度量化算法,协同底层算子团队实现异构硬件上的极致性能优化。要求精通模型压缩理论,深入理解剪枝、量化、知识蒸馏、稀疏化、低秩分解等技术的数学原理与工程权衡;具备大模型量化研究与工程经验,熟悉 SmoothQu...
负责多模态大模型(Vision-Language Model,VL/Omni)的研发与优化,重点面向端侧设备(移动端);设计与实现下一代端侧友好的模型结构,针对特定芯片进行算法与系统协同设计;研究并落地低比特量化(w4a8、w2a16、fp8),协助完成异构硬件(如 NPU)的模型部署;支持下游多模态 Agent、端云 Agent 协同、场景对话、实时感知等业务需求,探索 VLM 在端上实时场景中的新应用。要求熟悉主流 LLM、VLM、...