LLM预训练算法工程师
参与大规模预训练语言模型的预训练工作,主要涉及Scaling Law构建、性能优化、硬件适配等;根据需求复现相关自然语言处理算法;参与前沿算法与应用研究。要求具备自然语言处理、机器学习等相关专业背景,具备较强算法开发能力,熟悉C++、Python、Shell、CUDA等一种或多种编程语言,掌握传统NLP与深度学习NLP相关算法并有实战经验,熟练使用PyTorch、Megatron等深度学习框架,对深度学习、Transformer、预训练...
第 120 页,共 161 页
参与大规模预训练语言模型的预训练工作,主要涉及Scaling Law构建、性能优化、硬件适配等;根据需求复现相关自然语言处理算法;参与前沿算法与应用研究。要求具备自然语言处理、机器学习等相关专业背景,具备较强算法开发能力,熟悉C++、Python、Shell、CUDA等一种或多种编程语言,掌握传统NLP与深度学习NLP相关算法并有实战经验,熟练使用PyTorch、Megatron等深度学习框架,对深度学习、Transformer、预训练...
负责AIoT产品与能力体系建设,推动端侧AI能力在IoT场景中的产品化落地,包括语音、多模态感知、上下文理解、设备控制等;构建端侧智能能力框架,推动产品从被动控制向主动服务演进。围绕真实用户场景设计跨设备、跨品类联动体验,抽象高频场景并形成可复用模板与能力模块,提升场景自动化成功率、联动覆盖率及用户使用频次。与算法团队协作,推动端侧模型在IoT设备中的适配与优化,设计端云协同架构,在算力、功耗、成本受限条件下实现最优体验。定义IoT设备...
参与构建一套“自我优化”的大模型训练系统,工作方向包括参与模型训练并构造面向高性能与基础设施侧的专用模型,构建统一训练Harness范式以标准化训练、Benchmark与评测流程,探索Agentic Infra,将训练系统从人工驱动升级为Agent驱动,并推动训练系统从工具集合演进为具备自我优化能力的系统。要求具备较强工程能力,能独立完成复杂系统模块设计与实现,熟练使用Python,熟悉PyTorch并有实际训练与调试经验,理解分布式系...
负责AI算力调度平台核心服务的设计、开发与持续演进,支撑模型训练、研发调试、镜像管理、数据流转等关键场景。基于Kubernetes、Volcano构建资源管理、项目配额、任务调度、队列治理、优先级与抢占等核心能力,持续提升GPU资源利用率与平台吞吐能力。参与平台控制面架构设计,推动领域模型统一、接口规范升级和系统架构演进,推进REST向gRPC、同步接口向异步任务、单体能力向平台化能力升级。负责平台稳定性与可运维性建设,包括任务状态流转...
负责在Android、嵌入式Linux平台落地大模型与多模态推理系统,深入底层系统及GPU/DSP/NPU异构计算,优化模型性能和内存管理,确保AI推理在端侧高效稳定运行。工作包括端侧语言模型与多模态模型推理部署、异构硬件性能调优与内存管理、研究主流芯片厂商技术栈演进、推理框架与工具链及跨平台构建系统开发优化、模型量化与KV Cache管理及端侧推理优化,并跟进Transformer及其衍生变体、EAGLE等前沿模型架构与加速技术演进。...
专注于大语言模型和多模态模型在端侧或服务器端的量化与推理性能优化,围绕模型结构与数值特性设计稳定、可复现的量化方案,增强对不同模型结构的通用性;负责大模型与多模态模型的量化方案设计与实现;推进权重量化、激活量化及混合精度策略的工程化落地;分析和处理量化过程中的异常值,并评估其对精度的影响与策略选择;负责 KV Cache、Attention、FFN 等核心模块的量化与验证;完成量化模型在主流推理框架中的部署与问题排查;跟进主流模型架构与...