世界模型数据算法专家
主导世界模型训练数据体系建设,负责训练数据的全链路规划与落地,将行业领先的视频生成数据经验应用到世界模型训练中;深入理解模型架构与训练逻辑,推动数据工程与模型迭代协同设计,根据模型反馈和评测指标动态调整数据课程与配比,并从真实物理规律的数据分布出发,对模型结构设计和 Loss 权重分配提出优化建议;深入参与并主导训练数据的来源获取、清洗过滤、精细化标注等关键环节;建立数据质量与模型性能之间的闭环反馈,通过消融实验量化评估不同清洗和标注策...
第 15 页,共 21 页
主导世界模型训练数据体系建设,负责训练数据的全链路规划与落地,将行业领先的视频生成数据经验应用到世界模型训练中;深入理解模型架构与训练逻辑,推动数据工程与模型迭代协同设计,根据模型反馈和评测指标动态调整数据课程与配比,并从真实物理规律的数据分布出发,对模型结构设计和 Loss 权重分配提出优化建议;深入参与并主导训练数据的来源获取、清洗过滤、精细化标注等关键环节;建立数据质量与模型性能之间的闭环反馈,通过消融实验量化评估不同清洗和标注策...
主导世界模型训练数据体系建设,负责训练数据的全链路规划与落地,将行业领先的视频生成数据经验应用到世界模型训练中;深入理解模型架构与训练逻辑,推动数据工程与模型迭代协同设计,根据模型反馈和评测指标动态调整数据课程与配比,并从真实物理规律的数据分布出发,对模型结构设计和 Loss 权重分配提出优化建议;深入参与并主导训练数据的来源获取、清洗过滤、精细化标注等关键环节;建立数据质量与模型性能之间的闭环反馈,通过消融实验量化评估不同清洗和标注策...
研究和设计大模型的微调训练算法与推理算法适配,并结合实际场景进行效果和效率优化;负责特定功能方向的大模型微调训练并交付到实际业务场景;研究和设计微调模型效果提升方法;跟踪最新学术研究,并将研究成果应用到实际问题中。要求具备自然语言处理、机器学习等相关专业背景及3年以上相关工作经验,具备较强算法开发能力,熟悉 C++、Python、Shell、CUDA 等一种或多种编程语言,掌握传统 NLP 与深度学习 NLP 相关算法并有实战经验,具备...
参与大规模预训练语言模型的预训练工作,主要涉及Scaling Law构建、性能优化、硬件适配等;根据需求复现相关自然语言处理算法;参与前沿算法与应用研究。要求具备自然语言处理、机器学习等相关专业背景,具备较强算法开发能力,熟悉C++、Python、Shell、CUDA等一种或多种编程语言,掌握传统NLP与深度学习NLP相关算法并有实战经验,熟练使用PyTorch、Megatron等深度学习框架,对深度学习、Transformer、预训练...
负责AIoT产品与能力体系建设,推动端侧AI能力在IoT场景中的产品化落地,包括语音、多模态感知、上下文理解、设备控制等;构建端侧智能能力框架,推动产品从被动控制向主动服务演进。围绕真实用户场景设计跨设备、跨品类联动体验,抽象高频场景并形成可复用模板与能力模块,提升场景自动化成功率、联动覆盖率及用户使用频次。与算法团队协作,推动端侧模型在IoT设备中的适配与优化,设计端云协同架构,在算力、功耗、成本受限条件下实现最优体验。定义IoT设备...
参与构建一套“自我优化”的大模型训练系统,工作方向包括参与模型训练并构造面向高性能与基础设施侧的专用模型,构建统一训练Harness范式以标准化训练、Benchmark与评测流程,探索Agentic Infra,将训练系统从人工驱动升级为Agent驱动,并推动训练系统从工具集合演进为具备自我优化能力的系统。要求具备较强工程能力,能独立完成复杂系统模块设计与实现,熟练使用Python,熟悉PyTorch并有实际训练与调试经验,理解分布式系...
负责AI算力调度平台核心服务的设计、开发与持续演进,支撑模型训练、研发调试、镜像管理、数据流转等关键场景。基于Kubernetes、Volcano构建资源管理、项目配额、任务调度、队列治理、优先级与抢占等核心能力,持续提升GPU资源利用率与平台吞吐能力。参与平台控制面架构设计,推动领域模型统一、接口规范升级和系统架构演进,推进REST向gRPC、同步接口向异步任务、单体能力向平台化能力升级。负责平台稳定性与可运维性建设,包括任务状态流转...
负责在Android、嵌入式Linux平台落地大模型与多模态推理系统,深入底层系统及GPU/DSP/NPU异构计算,优化模型性能和内存管理,确保AI推理在端侧高效稳定运行。工作包括端侧语言模型与多模态模型推理部署、异构硬件性能调优与内存管理、研究主流芯片厂商技术栈演进、推理框架与工具链及跨平台构建系统开发优化、模型量化与KV Cache管理及端侧推理优化,并跟进Transformer及其衍生变体、EAGLE等前沿模型架构与加速技术演进。...