强化学习大模型研发工程师/研究员
研究基于 Long CoT 的大模型强化学习相关技术,包括算法或系统方向,实现技术突破,重点涉及推理能力(Reasoning)与智能体(Agent)方向;研究其他通往 AGI/ASI 的前沿技术。要求熟悉强化学习和大模型相关技术,具备相关实践或研究经验;有大模型基础设施研发经验或大模型与 Agent 相关研发经验者优先;有相关研究经历并发表过顶级会议论文者优先,如 ICLR、NeurIPS、CoRL、ICML、CVPR 等;具备扎实的...
第 55 页,共 113 页
研究基于 Long CoT 的大模型强化学习相关技术,包括算法或系统方向,实现技术突破,重点涉及推理能力(Reasoning)与智能体(Agent)方向;研究其他通往 AGI/ASI 的前沿技术。要求熟悉强化学习和大模型相关技术,具备相关实践或研究经验;有大模型基础设施研发经验或大模型与 Agent 相关研发经验者优先;有相关研究经历并发表过顶级会议论文者优先,如 ICLR、NeurIPS、CoRL、ICML、CVPR 等;具备扎实的...
从0到1搭建面向AI开发者的社区生态,制定开发者增长策略,推动开发者在产品内的使用、反馈与共创;结合行业趋势和公司产品能力,通过活动、任务、黑客松等形式,促进开发者真实使用与验证,沉淀高质量示例与应用案例;策划并组织线上线下技术活动,与内部技术团队和外部专家合作,提升开发者参与度及产品知名度;发现并维护核心开发者群体,建立激励与支持机制,推动社区知识与实践持续沉淀;拓展开源社区、AI工具平台及应用开发团队合作,联合推动产品集成和生态建设...
负责拓展并维护巴西市场科技、金融科技、AI行业相关KOL与创作者关系,重点覆盖 YouTube、Instagram、TikTok、Kwai、LinkedIn 巴西区及本土播客;结合巴西社媒生态与受众偏好,制定区域化KOL策略,完成达人筛选分层、媒介整合与预算规划,打造“品牌+本地创作者”合作矩阵;支持葡语/西语内容及业务传播,提升公司在巴西相关垂直圈层的品牌声量;追踪巴西社媒趋势与节日热点,快速产出本地化选题与素材;策划线上联动线下体验...
负责政府绿色通道的搭建与日常运营,确保监管侧投诉高效签收、处置与闭环;独立处理会员订阅相关的退费纠纷、服务争议及监管升级投诉,结合协议条款与法律规定判定退费合理性并制定解决方案;定期向监管侧报送脱敏投诉数据和分析报告,参与例会,并针对群体性投诉、媒体关注事件及行政复议风险,联动法务、公关、产品团队制定统一口径与应急预案;建立舆情监测机制,推动品牌联合维权与搜索结果优化;主导投诉数据分析,识别产品和计费流程中的问题并推动优化;搭建投诉案例...
深度参与 LLM 预训练方向的模型结构与训练方法研究,包括 MLP、Attention 模块改进,以及模型并行策略优化、优化算法改进、量化算法改进、目标损失函数改进等;通过科学实验设计和 scaling law 验证模型设计,积累从头开始、端到端的大模型训练经验,并提升模型训练效果与大规模推理效率。要求具备扎实的编程、数据结构与算法基础,熟练使用 PyTorch 或其他深度学习框架,具备深度学习训练和参数调优经验;有 LLM 训练、高性...
负责设计稳健运行的分布式服务架构,优化超大规模线上推理集群的运行效率。要求热爱编程,熟悉编译原理、操作系统、计算机网络等计算机基础知识;熟练掌握一种编程语言,Python、Golang、Rust、TypeScript 优先;对 AI 技术和分布式系统有强烈学习热情,具备良好的团队协作与沟通能力。加分项包括维护或参与 GitHub 开源项目、熟练使用 AI 编码工具并保持良好代码质量,以及具备大模型推理系统、分布式、网络、数据库相关研究、...
深度参与 LLM 创新模型架构的设计与改进,包括 MLP 和 Attention 模块;优化模型并行策略、优化算法和目标函数,提升模型训练效率与推理效果,推动上下文长度、参数规模和前沿性能达到领先水平;与 Infra 团队紧密合作,优化训练框架,提高 GPU 使用效率和训练任务稳定性;高效获取、清洗、构造和合成高质量预训练数据,持续探索可规模化的数据合成方法;参与模型训练任务监控,设计关键评测指标,确保模型训练效果符合预期。要求具备大模...