DataHub 关键词情报 · 数据更新至 2026-07-22
月之暗面算法与研究招聘
本页聚焦月之暗面算法与研究相关岗位,便于用户比较岗位职责、地点、薪资标注和详情入口。
活跃公司
- 月之暗面110 · 100.0%
热门地点
- 北京102 · 92.7%
- 上海5 · 4.5%
- 深圳3 · 2.7%
岗位方向
- 算法与研究110 · 100.0%
OPEN ROLES
代表岗位
大模型推理系统工程师
优化超大规模线上推理集群的运行效率和稳定性;跟踪最新模型进展,设计技术架构将模型应用到产品中;设计和优化工作流,通过自动化手段加速模型到产品的迭代效率;拥有良好的代码开发习惯,熟练掌握至少一种编程语言(如Python、Go、Rust),有代码洁癖者优先
大模型标注项目经理
全面参与标注项目的需求分析、规则制定、生产交付工作,确保交付质量与时效;准确理解大模型标注业务需求,撰写相关配套文档,对标注人员、验收人员进行培训答疑;搭建标注、验收团队,监控标注项目执行情况,解决过程风险
大语言模型预训练数据算法工程师
负责大语言模型预训练数据算法的设计与实现,包括数据选择、质量建模、去重、过滤、数据配比、合成数据与课程学习等方向;将数据算法落地到大规模数据处理流程中,基于Ray、Spark等分布式框架处理海量训练数据
云原生大模型训练平台工程师
基于Kubernetes构建稳定、可扩展的大模型训练平台,实现GPU算力资源的自动化管理与高效调度;通过自动化手段,保障内部超大规模训练任务的高效运行;优化训练作业调度器,优化拓扑感知、抢占与弹性扩缩容
大模型后端开发工程师
熟悉主流模型开放平台(Kimi、DeepSeek、Anthropic、OpenAI等),精通OpenAI API标准;将Function Call、MCP、Agent等大模型能力融入产品功能,推动多场景高效应用
模型-Harness协同进化研究员
研究Model-Harness协同进化,探索模型能力如何改变Harness设计,包括自生成工具、自动选择上下文、动态规划子任务、主动请求观测、错误恢复策略及多轮任务中的稳定工作习惯
研究科学家 / 工程师 – Agentic RL/基础设施
在Agentic、多智能体RL的算法、环境与基础设施上取得突破性进展;将Kimi K2及后续模型的自主能力推向真实世界;设计和实现大规模训练与低延迟推理系统;参与分布式基础设施的设计与优化
大模型推理加速算法实习生
研究并复现前沿 speculative decoding 方法,包括 EAGLE / EAGLE-3、Medusa、Hydra、Lookahead Decoding、Self-Speculative Decoding、MTP、DFlash、DFlare、DART 等方向
大模型产品经理实习生(医疗方向)
探索AI在医疗健康领域的机会,通过调研、数据分析等手段,定义用户使用场景;思考在新领域如何评估AI医疗能力并建立相关评估与训练数据集;与算法团队配合,通过综合手段,提升模型效果;关注与追踪相关领域新产品的PMF进展,形成研究报告
大模型强化学习研发实习生
研究基于Long CoT的大模型强化学习相关技术,包括算法或系统;实现技术突破,涉及推理能力(Reasoning)方向;研究智能体(Agent)方向;探索其他通往AGI/ASI的前沿技术
模型后训练Agent工程师/研究员-多模态方向
参与开发多模态理解和多模态agentic强化学习算法的研发与数据构造,提升大模型在应用场景中的效果;探索Think with Image、Visual Agent等相关范式,推动多模态大模型在复杂任务中的感知与决策能力
大语言模型评测实习生
深度参与大语言模型效果优化,为Scaling和Alignment提供鲁棒的实验观测指标;跟踪大语言模型前沿进展,引入有价值的Benchmark;参与评测平台开发,自动化收集、展示和分析实验结果,为实验提供有效反馈
HR实习生(大模型技术方向)
核心人才猎寻:深度参与AI大模型领域的人才招募,协助招聘团队负责销售类职位的全流程招聘工作,包括撰写和发布职位描述、筛选简历、安排面试等;招聘渠道拓展:通过多种渠道(如社交媒体、小红书、论坛等)发布招聘信息,拓展潜在候选人资源,主动挖掘符合岗位要求的优质人才
大模型算法研究员/工程师(预训练)
深度参与LLM的创新模型架构设计与改进,包括MLP和Attention模块;优化模型并行策略、优化算法、目标函数等方向,提升模型训练效率和推理效果;与Infra团队紧密合作,优化训练框架,提高GPU使用效率和训练任务的稳定性
大模型API解决方案架构师
作为客户技术问题的第一道入口,展现专业度以维持客户信任,必要时拉通内部资源;针对不同角色进行方案宣讲,结合技术可信度与商业敏锐度推动客户决策;深入客户业务场景,理解数据流、决策链和痛点优先级,共同定义成功落地方案
模型安全系统工程师
负责公司 AI 训练与推理基础设施的安全架构设计与核心模块开发,覆盖模型训练 Pipeline 安全、推理服务安全、模型部署安全等全生命周期;针对 GPU、NPU、TPU 等异构计算环境,设计并实施芯片级别的安全防护方案,包括 GPU 虚拟化安全隔离、显存加密保护、算力资源安全调度等
模型安全系统工程师 - 实习
AI训练与推理平台安全开发:参与公司AI训练与推理基础设施的安全模块开发,学习模型训练Pipeline安全、推理服务安全等全生命周期防护知识,协助完成安全功能的设计与编码实现;异构计算安全研究:针对GPU、NPU等异构计算环境,协助调研芯片级别的安全防护方案,参与GPU虚拟化安全隔离、显存加密保护…
大数据处理工程师(模型训练数据方向)
负责机器学习大规模训练数据的处理工作,确保数据质量和供给效率;设计、构建高效的数据流转、训练、测试系统,通过创新的工程加模型混合设计加速研发过程;发掘研发过程中显现的关键模式,通过合理的抽象和良好的设计构建便捷、鲁棒、可复用的库和服务
大模型数据运营专家
开展全球数据资源调研,深入理解Kimi模型训练的数据需求(预训练、SFT、RL、多模态),拆解数据类型、质量标准与分布目标;追踪AI数据产业趋势与供应商动态,开展全球市场情报扫描;发掘并管理海内外的优质数据供应商,建立横跨海内外的供应商筛选与准入机制,持续扩充全球化供应商池
大模型算法研究员/工程师(预训练)
深度参与LLM的创新模型架构设计与改进,包括MLP和Attention模块,优化模型并行策略、算法和目标函数,力争在上下文长度、参数规模和前沿性能上取得SOTA级领先水平;与Infra团队紧密合作,优化训练框架,提高GPU使用效率和训练任务稳定性,确保高效的计算资源利用
强化学习大模型系统工程师实习生
参与LLM的数据处理、数据生成与数据合成全流程;进行LLM预训练和对齐的数据质量提升、筛选与配比;覆盖中英文、数学代码、知识、多语言等多类型数据;通过prompt engineering生成智能体训练数据,为后训练提供优质数据支持
大模型强化学习研发实习生
研究基于Long Chain of Thought的大模型强化学习相关技术,包括算法或系统实现;探索推理能力(Reasoning)方向的算法突破;探索智能体(Agent)方向的技术创新
大模型API销售
深度挖掘互联网、AI出海客户的大模型API需求,建立并维护良好的客户关系;制定并执行销售策略,完成大模型API产品的销售指标;深入了解客户业务场景,提供定制化的大模型API解决方案;收集市场信息,分析竞品动态,为产品优化提供反馈
语言大模型架构/优化/scaling实习生
深度参与前沿大模型(LLM)的架构设计与迭代,重点攻关Attention机制(如MLA、Linear Attention、VQ)、MoE等SOTA结构的性能与效率瓶颈,推动模型在上下文长度与参数规模上实现突破
安全研究实习生
探索Agent在CTF 场景下的能力边界;分析并研究用户竞赛轨迹数据,通过Scaling Data提升模型性能;工程化实现CTF题目、writeup、环境及exp的整合与部署;参加过国内外CTF竞赛,具备一定的赛题审美能力
语言大模型架构/优化/Scaling实习生
深度参与前沿大模型(LLM)的架构设计与迭代,重点攻关Attention机制(如MLA、Linear Attention、VQ)及MoE等SOTA结构的性能与效率瓶颈;主导模型优化器与训练策略的研究,深入分析优化动力学,探索二阶优化(如Hessian-free)的可行性,并应用μ-Parametr…
LLM模型能力实习生
负责大语言模型(LLM)相关的数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据;研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量;深入探索LLM的data recipe,包括数据比例的优化和运维实验,以提升模型整体表现
LLM模型能力实习生
负责大语言模型(LLM)相关的数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据;研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量;深入探索LLM的data recipe,包括数据比例的优化和运维实验,以提升模型的整体表现
LLM模型能力实习生(预训练数据)
负责大语言模型(LLM)相关数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据;研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量;深入探索LLM的data recipe,包括数据比例的优化和运维实验,以提升模型整体表现
安全研究实习生
探索Agent在CTF领域的能力边界,分析并研究数据扩展方案以提升模型性能;工程化实现CTF题目、writeup、环境、exp等资源的整合与构建;参与AI Agent相关安全应用的研究与开发工作
安全研究实习生
探索Agent在CTF领域的能力,分析并研究行为轨迹,通过scaling data方式提升模型表现;工程化实现整合CTF题目、writeup、环境、exp等安全研究相关资源;参加过国内和国外的CTF竞赛,具备一定的赛题审美能力
Kimi-大模型产品经理实习生
设计并持续优化用于衡量大模型与Agent能力的benchmark与评测方案;与算法工程师协作,参与Agent工具体系设计与环境搭建;参与模型训练数据的构造与整理;基于用户场景,探索并定义Agent产品的能力边界与产品形态
多模态算法工程师(图文方向)
探索多模态预训练环节更高效的Data和Modeling方法,延续Scaling Law,探索并实现数据发现、清洗和生成策略;深入参与设计科学的MLLM实验,构建经济有效的训练数据recipe,探索数据配比与模型scaling相关的前沿技术
多模态算法工程师
负责多模态AIGC产品的算法开发与维护工作;以用户价值为第一要务,打造优质的ToC产品体验;与团队成员紧密沟通协作,高质量按期完成项目任务;排查用户反馈问题,持续优化系统性能,提升关键业务指标
多模态大语言模型算法(预训练方向)
深入参与设计科学的Kimi VLM scaling实验,构建有效的训练数据recipe,探索数据配比与模型scaling相关前沿技术;深度参与Kimi VLM数据清洗和优化,使用科学方式进行VLM预训练和对齐的数据质量提升、筛选和配比,涵盖图片、视频、视觉常识、视觉推理和多语种多模态数据等
AI Agent系统安全研究工程师
基于eBPF、系统调用追踪与内核安全机制,分析和监控Agent Runtime的进程、文件、网络等行为,提升Code Interpreter等高权限工具的运行时可观测性;研究Agent行为基线与异常检测方法,识别越权文件访问、异常网络外联、资源滥用、代码执行链路等安全风险,推动自动化处置能力建设
大模型API内容营销专家
深入挖掘各行业使用API的成功场景,撰写具有行业影响力的客户成功案例,量化价值创造;针对不同垂直领域将API能力封装为场景化解决方案,产出One-pager、行业白皮书、售前PPT等工具包
模型提升(优化器方向)
负责大模型训练过程中的优化器设计与调优工作;探索并改进优化算法以提升模型收敛速度与性能表现;配合团队完成模型训练效率的整体提升;熟悉主流深度学习框架及优化器实现原理;具备扎实的算法基础和较强的工程实现能力
大模型算法研究员 – Agentic RL/强化学习
在Agentic、多智能体RL的算法、环境与基础设施上取得研究突破;将Kimi K2及后续模型的自主能力推向真实世界应用场景;负责策略梯度、Actor-Critic、Self-Play、Meta-RL、MARL等强化学习算法的研发与优化
大模型算法研究员 – Agentic RL/强化学习
在Agentic、多智能体RL的算法、环境与基础设施上取得研究突破;将Kimi K2及后续模型的自主能力推向真实世界应用场景;负责千卡级大规模训练系统的开发与优化;设计并实现低延迟推理方案
大模型强化学习研发工程师/研究员(RL方向)
研究基于Long CoT的大模型强化学习相关技术,包括算法或系统,实现技术突破;探索推理能力(Reasoning)方向的前沿技术;探索智能体(Agent)方向的前沿技术;研究其他通往AGI/ASI的前沿技术
大模型API销售
深度挖掘互联网、AI出海客户的大模型API需求,建立并维护良好的客户关系;制定并执行销售策略,完成大模型API产品的销售指标;深入了解客户业务场景,提供定制化的大模型API解决方案;收集市场信息,分析竞品动态,为产品优化提供反馈
大模型API销售(高级客户经理)
深度挖掘互联网、AI出海客户的大模型API需求,建立并维护良好的客户关系;制定并执行销售策略,完成大模型API产品的销售指标;深入了解客户业务场景,提供定制化的大模型API解决方案;收集市场信息,分析竞品动态,为产品优化提供反馈
大模型API解决方案架构师
深入理解客户业务需求,提供专业技术咨询服务;基于大模型API能力,设计符合客户场景的技术解决方案;向客户展示产品功能,进行技术演示和PoC验证;与销售、产品、研发团队紧密配合,推动项目成功交付
大模型强化学习研发实习生
研究基于强化学习的Agent/Multi-Agent学习机制;提升模型在前沿全栈项目上的代码生成等Agent能力;研发更精准的Reward Model以指导模型对齐人类的价值观和需求;使模型和Agent具备长期的记忆和学习能力
语言大模型架构/优化/Scaling实习生
深度参与前沿大模型(LLM)的架构设计与迭代,重点攻关Attention机制(如MLA, Linear Attention, VQ)、MoE等SOTA结构的性能与效率瓶颈,推动模型在上下文长度与参数规模上实现突破
强化学习算法研究员(大模型)
研究基于Long CoT的大模型强化学习相关技术,包括算法或系统,实现技术突破;研究方向一:推理能力Reasoning;研究方向二:智能体Agent;研究其他通往AGI/ASI的前沿技术
高级算法系统工程师
设计并构建高效的数据流转、训练、测试系统;通过合理的工程和系统抽象极大加速研发过程;发掘研发过程中的模式,构建便捷、鲁棒、可复用的library和service;参与Kimi跨模态通用模型的开发工作
模型算法实习生(强化学习/后训练方向)
设计并构建良好的基准测试,用于评估模型的新能力;了解经典强化学习算法,具备在大语言模型或传统游戏等场景下成功训练强化学习的经验;熟悉VeRL、vLLM、Megatron等主流强化学习相关框架
LLM模型能力实习生
负责大语言模型(LLM)相关的数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据;研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量;深入探索LLM的data recipe,包括数据比例的优化和运维实验,以提升模型的整体表现
语言大模型架构/优化/Scaling实习生
深度参与前沿大语言模型(LLM)的架构设计与迭代,重点攻关Attention机制(如MLA、Linear Attention、VQ)、MoE等SOTA结构的性能与效率瓶颈;推动模型在上下文长度与参数规模上实现突破
Agentic RL 研究科学家/工程师
在Agentic、多智能体RL的算法、环境与基础设施上取得技术突破;将Kimi K2后续模型的自主能力推向真实世界应用场景;负责策略梯度、Actor-Critic、Self-Play、Meta-RL、MARL等RL算法的研发与优化
大语言模型预训练数据实习生
负责大语言模型(LLM)相关的数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据;研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量;深入探索LLM的data recipe,包括数据比例的优化和运维实验,以提升模型的整体表现
大模型RL Infra研究工程师
维护和开发Moonshot内部的强化学习后训练框架;支持万亿参数模型在reasoning、agentic等方向的文本及多模态RL后训练;与训练推理引擎团队合作,探索算法、框架、硬件的协同设计
大模型算法研究员/工程师(预训练)
深度参与LLM的创新模型架构设计与改进,包括MLP和Attention模块;优化模型并行策略、优化算法、目标函数等方向,提升模型训练效率和推理效果;力争在上下文长度、参数规模和前沿性能上取得SOTA级领先水平
LLM模型能力实习生
负责大语言模型(LLM)相关的数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据;研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量;深入探索LLM的数据配方(data recipe),包括数据比例的优化和运维实验,以提升模型的整体表现
大模型后训练Agentic RL/通用智能体研究员
研究基于Long CoT的大模型后训练-强化学习相关技术,包括算法或系统,实现技术突破;负责推理能力(Reasoning)方向的技术研发;负责智能体(Agent)方向的技术研发;研究其他通往AGI/ASI的前沿技术
多模态强化学习研究员
参与开发多模态大模型对齐及强化学习算法研发、数据构造,提升大模型在应用场景的效果;与Kimi产品、Kimi开放平台等团队合作,实现大模型实际应用中需要的功能点;评估并跟踪大模型在实际应用中的表现,通过优化模型性能,提升产品的用户满意度
大模型强化学习研发工程师/研究员(RL方向)
研究基于Long CoT的大模型强化学习相关技术,包括算法与系统层面的创新;推动推理能力(Reasoning)方向的技术突破与工程实现;探索智能体(Agent)方向的前沿技术与应用场景
语言大模型架构/优化/Scaling实习生
深度参与前沿大模型(LLM)的架构设计与迭代,重点攻关Attention机制(如MLA, Linear Attention, VQ)、MoE等SOTA结构的性能与效率瓶颈;推动模型在上下文长度与参数规模上实现突破
LLM模型能力实习生
负责大语言模型(LLM)相关的数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据;研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量;深入探索LLM的data recipe,包括数据比例的优化和运维实验,以提升模型的整体表现
安全研究实习生
探索Agent在CTF领域的应用边界;分析并研究CTF解题轨迹;构建Scaling Data以改善底座模型性能;整合CTF题目、Writeup、环境、EXP等资源;集成CTF工具集,制作Agent友好环境
RL-LLM数据算法/工程实习生
深度参与LLM的数据处理、数据生成和数据合成工作;使用科学方式进行LLM预训练和对齐的数据质量提升、筛选和配比;覆盖中英文、数学代码、知识、多语言等多种数据类型;通过prompt engineering等方式生成智能体训练数据,为后训练提供优质数据
HR招聘实习生(大模型技术方向)
在招聘网站、GitHub、技术论坛等渠道主动搜寻和初步筛选技术候选人;全流程协调安排技术岗位面试,跟踪反馈与候选人状态;维护技术人才库,进行Mapping与人才关系运营;追踪大模型领域技术动态与人才市场趋势
语言大模型架构/优化/Scaling实习生
深度参与前沿大模型(LLM)的架构设计与迭代,重点攻关Attention机制(如MLA, Linear Attention, VQ)、MoE等SOTA结构的性能与效率瓶颈,推动模型在上下文长度与参数规模上实现突破
多模态算法工程师
深入参与设计科学的Kimi VLM scaling实验,构建经济有效的训练数据recipe;探索数据配比、模型scaling相关的前沿技术,深入了解MLLM基座模型训练方法;深度参与Kimi VLM的数据清洗和优化,使用科学方式提升VLM预训练和对齐的数据质量
多模态强化学习研究员
参与开发多模态大模型对齐及强化学习算法研发、数据构造,提升大模型在应用场景的效果;与Kimi产品、Kimi开放平台等团队合作,实现大模型实际应用中需要的功能点;评估并跟踪大模型在实际应用中的表现,通过优化模型性能,提升产品的用户满意度
研究科学家/工程师
在Agentic、多智能体强化学习的算法、环境与基础设施上取得技术突破;将Kimi K2及后续模型的自主能力推向真实世界应用场景;负责策略梯度、Actor-Critic、Self-Play、Meta-RL、MARL等RL算法的研发与优化
强化学习-大模型研发工程师/研究员
研究基于Long CoT的大模型强化学习相关技术,包括算法与系统优化;推动推理能力Reasoning方向的技术突破与创新;探索智能体Agent方向的强化学习应用与研发;研究其他通往AGI/ASI的前沿技术路径
大模型数据Eval产品经理
设计、搭建并持续迭代大模型多维度评测框架,让模型能力可衡量、可对比、可解释;与算法团队配合,将评测结论转化为数据需求,寻找提升模型智能的关键数据并推动落地;跟踪前沿论文与开源社区,第一时间将新评测维度、数据策略落地到业务中
大模型Eval产品经理(测评&优化提升)
设计、搭建并持续迭代大模型多维度评测框架,实现模型能力的可衡量、可对比、可解释;与算法团队配合,将评测结论转化为数据需求,寻找提升模型智能的关键数据并推动落地;跟踪前沿论文与开源社区,第一时间将新评测维度、数据策略落地到业务中
大模型数据Eval产品经理
设计、搭建并持续迭代大模型多维度评测框架,实现模型能力的可衡量、可对比、可解释;与算法团队配合,将评测结论转化为数据需求,寻找提升模型智能的关键数据并推动落地;跟踪前沿论文与开源社区动态,第一时间将新评测维度、数据策略落地到业务中
强化学习-大模型研发工程师/研究员
研究基于Long CoT的大模型强化学习相关技术,包括算法与系统,实现技术突破;方向一:专注推理能力Reasoning的研究与开发;方向二:专注智能体Agent的研究与开发;研究其他通往AGI/ASI的前沿技术
大模型API解决方案架构师
深入理解客户业务需求,提供专业技术咨询服务;基于大模型API能力,设计符合客户场景的技术解决方案;向客户展示产品功能,进行技术演示和PoC验证;与销售、产品、研发团队紧密配合,推动项目成功交付
大模型API内容营销专家
深入挖掘各行业使用API的成功场景,撰写具有行业影响力的客户成功案例,量化价值产出并形成可复用的行业解决方案;针对不同垂直领域封装场景化解决方案,产出One-pager、行业白皮书、售前PPT等销售工具包,协助BD团队梳理客户痛点
大数据处理工程师(模型训练数据方向)
负责机器学习的大规模训练数据处理;设计、构建高效的数据流转、训练、测试的系统;通过创新的工程+模型混合设计,加速研发过程;发掘研发过程中的模式,通过合理抽象和良好设计构建便捷、鲁棒、可复用的库和服务
Agent模型评估产品经理
负责构建大模型在真实应用场景下的行为与质量评估体系,涵盖用户价值、可靠性、多模态表现、安全性等维度;从用户反馈、模型行为观察、研究侧目标中提炼评估方向,并形成评估结论推动模型迭代;持续迭代评估方法,包括可扩展的自动化Evals、Benchmark任务设计、评估工具链与流程优化
大模型API解决方案架构师
深入理解客户业务需求,提供专业技术咨询服务;基于大模型API能力,设计符合客户场景的技术解决方案;向客户展示产品功能,进行技术演示和PoC验证;与销售、产品、研发团队紧密配合,推动项目成功交付
大模型API销售
深度挖掘互联网、AI出海客户的大模型API需求,建立并维护良好的客户关系;制定并执行销售策略,完成大模型API产品的销售指标;深入了解客户业务场景,提供定制化的大模型API解决方案;收集市场信息,分析竞品动态,为产品优化提供反馈
大模型算法工程师
参与开发多模态大模型对齐及强化学习算法研发、数据构造,提升大模型在应用场景的效果;与Kimi产品、Kimi开放平台等团队合作,实现大模型实际应用中需要的功能点;评估并跟踪大模型在实际应用中的表现,通过优化模型性能,提升产品的用户满意度
相关搜索词
这些词用于覆盖真实搜索需求,也方便用户继续定位公司、城市、岗位方向和薪资信息。