KIMI数据开发工程师
岗位描述:负责数据平台架构设计与开发,设计与开发全链路血缘、自助打标平台、指标管理等工具平台;基于对数据链路的理解,优化和改善现有流程与性能,提升数据稳定性与时效性;负责业务数仓建设,独立完成数据各层级建模,构建成熟稳定的数据仓库;构建流批一体架构,基于 Flink、Kafka、数据湖等技术实现实时与离线数据 Pipeline;主动思考并推动数据价值发掘,为模型迭代、产品决策、用户增长提供高质量数据支撑。 岗位要求:计算机、数学、统计学...
第 23 页,共 161 页
岗位描述:负责数据平台架构设计与开发,设计与开发全链路血缘、自助打标平台、指标管理等工具平台;基于对数据链路的理解,优化和改善现有流程与性能,提升数据稳定性与时效性;负责业务数仓建设,独立完成数据各层级建模,构建成熟稳定的数据仓库;构建流批一体架构,基于 Flink、Kafka、数据湖等技术实现实时与离线数据 Pipeline;主动思考并推动数据价值发掘,为模型迭代、产品决策、用户增长提供高质量数据支撑。 岗位要求:计算机、数学、统计学...
岗位描述:负责数据平台架构设计与开发;设计与开发全链路血缘、自助打标平台、指标管理等工具平台;基于对数据链路的理解,优化与改善现有流程与性能,提升数据的稳定性和及时性;负责业务数仓建设,独立完成数据各层级建模,构建成熟、稳定的数据仓库;构建流批一体架构,基于 Flink、Kafka、数据湖等技术实现实时与离线数据 Pipeline;主动思考并推动数据价值发掘,为模型迭代、产品决策、用户增长提供高质量数据支撑。 岗位要求:计算机、数学、统...
岗位描述:负责数据安全核心系统的研发与架构设计,围绕数据分类分级、敏感数据扫描、动态/静态脱敏、加解密服务、访问控制网关、DLP 引擎、UEBA 行为审计等场景,构建高性能、可扩展的数据安全中台与治理平台;负责将数据安全策略产品化、工程化落地,协同产品、研发、算法团队,将用户隐私保护、模型训练/推理数据安全、Prompt 及模型输出管控等安全需求转化为系统能力,研发数据防泄漏、反爬虫等安全防护系统;负责数据安全基础设施的研发与迭代,包括...
岗位描述:研究基于 Long CoT 的大模型强化学习相关技术,包括算法或系统方向,推动技术突破,重点涉及推理能力(Reasoning)与智能体(Agent)方向;研究其他通往 AGI/ASI 的前沿技术。 岗位要求:985/211 高校研究生及以上学历或优秀本科生,计算机科学、人工智能、机器学习等相关专业;熟悉强化学习和大模型相关技术,具有相关实践和研究经验者优先;有大模型基础设施(Infra)相关研发经验者优先;有大模型与 Agen...
岗位描述:面向 2C 用户、开发者及 ToB API 企业用户的客服运营团队,推动客服体系从传统服务向用户运营(VOC)进化。负责搭建客服服务流程、分级响应机制(SLA)、质量标准与考核体系;建设并持续维护客服知识库,推进 AI Chatbot 等智能工具在业务中的落地与优化,负责知识库全生命周期管理;深入理解 LLM / Agent 技术,独立或与产研协作搭建 Agent 产品,并推动智能客服工具在 API 产品团队中的接入与迭代;从...
岗位描述:负责政府绿色通道的搭建与日常维护,确保监管侧投诉高效签收、处置和闭环;独立处理Kimi商业化会员订阅相关的退费纠纷、服务争议及监管升级投诉,结合协议条款与法律规定判定退费合理性,并制定包括全额/部分退费、延期服务、权益置换等解决方案;定期向监管侧报送脱敏投诉数据、季度分析报告并参与月度例会;针对群体性投诉、媒体关注事件、行政复议风险,联动法务、公关、产品团队制定统一口径与应急预案;建立微博、小红书、黑猫投诉等平台的监测机制,推...
岗位描述:深度参与 LLM 的模型结构设计,包括 MLP 和 Attention 模块改进,以及训练方法设计,涵盖模型并行策略优化、优化算法改进、量化算法改进、目标损失函数改进等方向,目标是在模型训练以及大规模推理效率上取得 SOTA 级领先水平;深入调研科学实验设计方法,利用 scaling law 验证模型设计,积累从头开始、端到端的大模型训练经验。 岗位要求:本科及以上学历,计算机、人工智能、自动化、数学专业优先;具备扎实的编程基...
岗位描述:负责公司机器学习的大规模训练数据处理。 岗位要求:具备数据处理、清洗、标注,或推荐系统、搜索、广告排序等项目开发经验,并在项目中承担重要角色;熟练使用 Python;熟练使用 Spark 或 Ray,使用过 TensorFlow 或 PyTorch 中至少一种;熟悉分布式系统,能够设计大规模离线分布式系统,并具备大规模存储经验;熟悉 NLP 或 CV,有实际训练 NLP 或 CV 模型并上线的经验;具备良好的思维能力、独立思考...
岗位描述:负责大语言模型预训练数据算法的设计与实现,包括数据选择、质量建模、去重、过滤、数据配比、合成数据与课程学习等方向;将数据算法落地到大规模数据处理流程中,基于 Ray、Spark 等分布式框架处理海量训练数据;设计并执行数据消融实验,评估不同数据源、质量过滤策略、去重策略、配比方案和采样策略对模型能力的影响;建设从数据到模型效果的实验闭环,结合训练 loss、benchmark、能力维度评测、训练动态和样本分析,定位数据问题并持...