DataHub 关键词情报 · 数据更新至 2026-07-22
阶跃星辰招聘信息
本页聚合阶跃星辰在 DataHub 当前公开岗位库中的招聘信息,重点展示岗位数量、城市、岗位方向和代表职位。
活跃公司
- 阶跃星辰719 · 100.0%
热门地点
- 北京570 · 79.3%
- 上海141 · 19.6%
- 深圳8 · 1.1%
岗位方向
- 算法与研究380 · 52.9%
- 工程与基础设施200 · 27.8%
- 其他岗位68 · 9.5%
- 产品与运营54 · 7.5%
- 职能与支持14 · 1.9%
- 销售与客户3 · 0.4%
OPEN ROLES
代表岗位
AI编程大模型应用工程师
深入探索大语言模型在编程场景中的应用,参与Coding Agent开发,探索顶尖AI编程模型和框架的能力边界;持续探索创新的评测方法,提出更好的基准测试,定义模型能力,通过数据分析和算法改进优化大模型应用效果,跟踪数据变更对模型的影响,与算法团队配合进行数据实验,形成可量化的反馈机制
产品营销与商业增长负责人
定义目标客群与优先场景(如Coding、Agent等),建立面向开发者的价值主张、差异化卖点与可复述的产品叙事;开拓并维护中间件平台(LangChain、Dify、OpenClaw)、开发工具(Cursor、Windsurf)、云市场、代理商等渠道合作网络,将StepFun打造成生态默认选项
商业化产品经理(开放平台方向)
负责Step Platform的商业化产品规划,围绕开发者商业增长目标,设计并推动市场增长、生态合作、直销协同等多路径增长方案,提升注册、活跃、转化、续费与收入规模;推动开放平台基础能力建设,包括文档、SDK、接入流程、开发者控制台、调试工具、示例工程等,提升开发者接入效率与付费转化效率
大宗商品AI算法专家
构建覆盖全球宏观指标、行业基本面及替代品价格的多因子时序预测模型;探索Transformer、Mamba等前沿架构在商品价格预测中的应用,持续迭代模型精度;利用大语言模型自动提取研报、新闻、政策文本中的关键供需信号,实现非结构化信息的定量化
AI解决方案架构师
跟踪并分析国内主流大模型的最新进展,包括模型架构、性能指标和应用场景;与客户和内部团队合作,深入理解各行业对AI技术及大模型、高性能计算的需求;基于“国模+国芯”技术栈,设计并优化行业解决方案架构,确保可行性、可扩展性和高性能
推理云平台高级研发工程师
负责推理云平台核心系统的架构设计与关键模块开发,建设服务控制面、配置管理、发布变更、运行治理等平台能力;面向大规模IDC与云上环境,设计和演进平台基础设施架构,提升系统在复杂部署场景下的稳定性、扩展性与可运维性
高级测试开发工程师(AI方向)
负责从需求分析、技术方案评审到上线验收的全流程质量管理,进行根因分析并推动技术债解决;负责系统高可用性、稳定性及性能测试,制定极限场景下的容灾验证方案;负责AI应用项目在客户现场或生产环境的交付测试,确保交付物的完整性、兼容性及稳定性
Android功耗优化工程师
负责Android终端系统功耗问题的分析与深度优化,攻克疑难复杂功耗问题,提升设备续航能力;设计并落地端云协同的功耗优化闭环体系,实现端侧软硬件异常功耗的精准管控和智能自愈;负责端侧功耗数据采集与上报,实时捕获硬件状态、软件行为及用户场景等数据,确保数据完整性与低开销
高级审计经理
执行全业务审计项目,包括制定审计计划与策略、现场实施、取证与报告,揭示内控缺陷和舞弊隐患,促进内控改进闭环;评估内控设计与执行的有效性,参与内控制度、流程和标准的建设与优化;开展经济舞弊风险核实、投诉调查和舞弊线索查证,进行证据固定、结论报告和问责建议
智能硬件结构件质量工程师
负责智能硬件结构件开发、量产及售后全生命周期质量管理,包括过程质量管理、生产线体符合性审核、故障分析及解决;负责供应商质量管理、质量绩效考核及结果应用,监督供方生产过程质量数据,推动物料品质问题解决、制程改善及良率提升
机电物料质量工程师
负责屏幕、Camera、电池等机电物料新项目开发阶段的质量看护,包括前期风险识别、设计评审及物料NCR推进;负责屏幕、Camera、电池等机电物料开发前置管理(DFM),提前识别物料质量风险
AI编程产品经理
与研究团队协作,判断模型在编程场景的能力边界,定义可产品化的能力及需继续投入的方向,将用户痛点转化为模型优化目标;跟踪AI编程竞争格局,前瞻性规划产品方向,探索编程之外的相邻场景拓展
Android底层稳定性工程师
负责Android设备底层稳定性保障,聚焦内核、HAL、底层系统服务及驱动模块,解决系统级崩溃、异常重启、功能失效等核心问题,提升设备长期运行可靠性;构建底层稳定性指标体系与监控平台,制定关键指标基线,通过实时监控与趋势分析提前发现潜在风险
音频系统工程师
负责手机平板产品中音频系统的研发、调试与优化,包括语音、媒体播放、通话、录音等音频场景;参与手机平板音频架构设计、方案评估及硬件选型,协调软件与硬件接口定义;负责音频驱动(Audio HAL)、音频中间层(AudioFlinger)或相关音频算法模块的开发与维护
销售财务BP
协助销服管理系统上线及迭代,推动订单、合同、返利、售后服务、费用报销等财务流程标准化与线上化,提升业财协同效率;协助销售目标拆解至区域、产品线及个人,参与销售预测模型搭建与滚动更新,输出偏差分析,支撑资源配置
AI产业分析师
构建核心投研认知:搭建公司在AI领域的底层研究模型,通过深度梳理技术脉络、产业演进及商业落地周期,定义AI行业研究的标准框架与核心变量,为公司产品提供逻辑支撑;前瞻性的行业洞察:独立负责AI相关重点行业的深度跟踪与前瞻性分析,从市场噪声中提炼具有决策价值的产业逻辑
内容安全解决方案专家
深入理解内容安全业务,收集并梳理各方需求,定义和规划内容安全解决方案;负责解决方案的整体框架设计,包括数据需求、模型管线、评估指标和上线标准,确保方案兼顾技术前瞻性与落地可行性;驱动项目从概念到应用的全流程,协调数据、算法、工程团队紧密协作,确保各环节按时高质量交付
AI模型效果评估专家
为模型效果提供输入、反馈与评测;与toB团队及效果产品经理配合;输出策略与洞察,确保模型工程化后效果不打折;负责数据回流与benchmark设定;具备技术背景与模型趋势sense;懂模型能力、工程化与用户痛点
AI/深度学习工程师
参与大模型背景下的分布式编程技术开发与优化;应用深度学习框架(如PyTorch/TensorFlow/JAX)进行模型训练与部署;研究和实现Transformer架构在多模态领域的应用
手机软件项目经理
负责手机软件项目开发的整个过程,包括从项目启动阶段到量产阶段,以及EWP售后维护阶段;带领项目团队识别并消除风险,进行流程优化和提高业务效率;协助跨职能部门间沟通管理,拉起各个团队梳理问题,明确解决方案,持续提升跨组织协作效率以推动业务目标达成
海外市场战略与商业分析专家
定义海外市场分层、理想客户画像、区域与客户优先级以及各垂直行业的价值主张;与管理层共同负责定价与打包分析、交易测算以及配额/目标设定;搭建经营看板,将一线信号转化为团队真正会采取行动的战略建议
GTM策略专家
制定并执行GTM策略,确保增长目标的有效落地;作为产品、研发、设计、商务之间的桥梁,拉通内部资源推动跨部门协调;利用AI coding工具快速搭建小产品(如市场新闻跟踪工具),嵌入日常GTM工作流以提升团队效率
包装结构设计师
在品牌背景下,参与智能终端生态硬件产品的包装结构设计;以用户为中心,发掘并产生启发包装设计的见解,应用于包装设计概念、结构设计、材料应用、包装策略和识别特征系统、设计流程或开箱体验中
包装平面视觉设计师
在品牌背景下,负责智能终端生态硬件产品的包装平面视觉设计与核心KV定义;以用户为中心,发掘并产生启发包装视觉设计的见解,应用于视觉概念、平面设计、排版系统、印刷工艺、标签合规及开箱动线
间接采购经理
负责人力外包、市场推广、专业服务等间接采购品类的采购,完成从需求整合、寻源、商务谈判、合同签署到交付落地的全链路管理;定期分析行业市场变化及业务趋势,制定成本控制方案,并持续改进;负责供应商开发、准入、评估等管理工作,持续优化供应商资源,提升交付质量
强化学习训练基础设施工程师
负责Agentic RL训练基础设施建设,覆盖沙箱/环境运行时、脚手架、多阶段强化学习工作流、评估与回放等核心链路;支持大规模环境生产、数据回流与训练闭环,持续优化系统稳定性、吞吐量与可扩展性
新产品导入工程师
负责新产品导入(NPI)过程中的资源协调及进度跟进;参与产品制造过程中的问题分析及解决,确保产品质量符合标准;拉通各职能部门进行生产流程的改进,提高生产效率和良率,保障爬坡量产以及量产交付
大模型后训练系统工程师
构建基础训练/推理引擎,保障精度并优化效率;优化低精度训练/推理效率,确保训练与推理一致性;设计/优化大规模强化学习框架,面向下一代长程任务进行深度优化;加强稳定性建设,提升大规模训练中的容错定位与恢复效率
大模型API产品ToB销售经理
负责大模型API产品的ToB销售执行,主动挖掘并触达潜在企业客户,跟进销售线索,完成个人销售目标;日常维护客户关系,梳理并分析客户的业务场景与需求,配合售前及产研团队输出相应的AI落地解决方案
高级销售运营经理
推动公司销售战略及业务目标落地,跟踪业绩达成情况并持续优化销售策略;搭建和完善销售数据分析体系,定期输出经营分析报告,为业务决策提供支持;建立销售过程管理机制,提升团队运营效率和执行质量
大模型后训练引擎工程师
负责后训练阶段SFT、RL等训练引擎建设与分布式训练性能优化,支撑不同后训练任务的高效接入、稳定运行与规模化迭代;负责低精度训练能力建设,提升低精度训练场景下的效率、精度与稳定性;负责长上下文训练能力建设,支撑长序列后训练任务的高效训练
大模型评测工程师
跟进学术界和企业界前沿的评测基准,持续健全世界级SOTA模型的观测榜单,例如AIME、GPQA、HLE、Codeforces、SWE、MultiChallenge、BrowseComp、Tau-Bench、Aider、MMMU、MathVista等
成本会计
负责公司产品成本核算工作,梳理适配代工生产模式的成本核算流程;核对不同存货类型下的采购成本、代工费、辅料费等各项生产费用,精准归集、分摊产品生产成本;为产品定价、盈利分析、成本管控提供核心数据支撑
API平台产品经理
主导API定价体系设计,包括按Token定价、套餐包、企业订阅等多种计费模型的产品方案;深入分析OpenAI、Anthropic、Google及国内厂商的定价策略,结合阶跃模型能力制定有竞争力的定价方案
嵌入式系统软件工程师
负责主控芯片(基于ARM Cortex-M/R/A系列或同等性能替代芯片)的嵌入式系统软件整体架构设计、搭建与实现;负责从零开始或深度定制Bootloader、板级支持包,并完成底层硬件抽象层驱动的开发与移植
MaaS平台研发工程师
负责MaaS平台核心能力建设,包括模型服务、Agent服务与开发者平台研发;设计并实现模型接入、推理调度、鉴权计费、流量治理、监控运维等核心系统;优化高并发、高可用、低延迟服务架构,支撑企业级客户稳定运行
语音大模型Agent工程师
负责语音大模型Agent能力建设,包括实时语音交互、多轮对话、任务执行与工具调用能力研发;参与ASR、TTS、语音理解、语音智能体等核心能力的工程化落地;构建面向企业场景的语音Agent工作流、Prompt、记忆与规划能力
金融AI Agent系统开发工程师
负责面向金融场景的企业级AI Agent系统建设,打造具备信息检索、分析推理和报告生成能力的智能助手;负责设计和开发多Agent协同架构、知识库管理、会话管理、记忆系统的AI Agent解决方案,保障系统的稳定性、可观测性和可扩展性,支撑多轮对话和复杂需求落地
AI Agent产品经理
负责AI Agent产品的规划、设计与迭代,探索AI在金融、零售等重点垂类方向的应用;定义用户画像,深入理解用户工作流,挖掘真实需求,设计Agent Workflow与交互方案;与算法、工程等团队紧密协作,建立Agent评测体系,分析归因问题,优化大模型生成效果,为最终效果负责
嵌入式Linux底层开发工程师
负责嵌入式Linux内核裁剪、移植、定制与补丁开发,适配ARM、RISC-V等芯片平台;负责U-Boot、设备树、根文件系统定制,优化启动流程,实现系统轻量化适配;负责I2C/SPI/UART/CAN等总线及各类外设驱动开发、移植与调试,保障软硬件稳定适配
金融AI Agent研究员
参与金融Agent评测基准的建设,设计严谨的评估方法,拆解LLM Trading Agent的收益来源;开发7×24小时市场信息Agent,实现风口挖掘、热点前瞻、主题选股、个股深研等功能
RTOS嵌入式开发工程师
负责各类MCU平台RTOS系统移植、适配、开发与性能优化,保障系统实时性、稳定性,支撑产品量产;负责RTOS内核模块裁剪、调试与迭代,熟练运用任务调度、中断处理、内存管理、消息队列、信号量等核心机制
资金管理专员
日常资金结算执行与台账管理:完成对公付款、费用报销等支付操作,前置核对付款单据、审批流程、收款账户信息;定期登记资金日记账,完成银行对账、编制余额调节表并清理未达账项,独立维护付款申请台账
高级APP测试工程师
负责APP产品的全流程测试工作,主导测试计划制定、用例设计、执行与缺陷管理,保障上线质量;同时覆盖后端接口及提效相关测试,提升整体测试效率;担任APP整体测试负责人或核心模块测试负责人,统筹测试资源,把控测试进度与风险,推动跨团队(开发、产品等)问题解决
AI大模型生态合作运营经理
负责AI大模型供应商的资源对接、商务洽谈与合作落地,维护长期合作关系;跟踪模型版本、定价、配额、SLA等关键信息,持续优化供应商组合;配合销售团队拓展外部B端渠道,输出合作方案与商务素材
销售运营管理专家
承接公司战略导向,结合产品策略及风险控制要求,设计并优化销售管理规则,包括客户管理、业绩管理、销售激励等规则;协调和推动团队内销售相关管理规则的落地执行,涵盖商机管理、客户管理、签约模式、项目流程管理及项目回款等
财务BP(业务伙伴)
支持BU新品上市及迭代,负责目标成本设定、投资回报分析及成本持续优化;建立产品从立项到退市的财务模型,分阶段跟踪投入产出;审批业务需求、项目评审及项目例会;搭建并持续优化BU经营分析报告体系,按月出具经营分析报告,识别经营风险与改善机会
AI技术负责人(钢铁行业)
组建并领导高效的工程团队,构建工业级AI流水线,实现从离线建模到在线推理的自动化闭环;主导“机理+数据”双驱动模型架构设计,将热平衡、物料平衡等物理约束引入AI模型,解决模型不收敛和反直觉问题
沙盒化基础设施平台研发工程师
参与沙盒化基础设施平台的设计、研发和持续演进,支撑多类业务场景下的安全运行环境需求;负责运行时、资源管理、任务调度、存储访问、网络隔离等平台核心能力建设;参与容器、轻量虚拟化、云原生存储等相关技术方案的调研、选型、工程实现和优化
信息安全审计专家(AI方向)
根据法律法规合规基线,结合公司实际业务,制定信息安全审计策略;搭建审计框架、风险清单与检查清单,持续优化审计SOP与风险评分模型;独立执行IT一般性控制、网络安全、数据安全、个人信息保护、内容安全及第三方安全等六大领域的信息安全审计
机器人运动控制算法工程师
负责多自由度机械臂/高动态腿足机器人运动控制算法的设计、开发、仿真验证与落地应用,涵盖运动学正逆解、动力学建模与补偿、轨迹规划、伺服控制等核心模块;搭建并优化机械臂/腿足机器人仿真环境,开展算法离线仿真测试、参数调优及性能验证,保障算法稳定性与可靠性
大模型服务平台产品经理
负责大模型服务平台的产品规划与路线图设计,推动产品从内部基础设施向企业级服务演进;设计企业级核心能力:商业化计费、多模型路由与降级策略、Token计量计费、资源池隔离、租户、SLA保障、KEY管理与权限体系等
办公安全工程师
负责办公终端DLP策略优化、日常运维,防范数据泄露风险;推进EDR部署,负责日常运营、异常处置及事件溯源;负责反病毒系统运维、病毒查杀及事件复盘,建立常态化防护机制;建设反钓鱼邮件体系,拦截钓鱼邮件、处置相关事件并优化防护策略
云资源管理系统架构师
负责云资源管理系统的架构设计与建设,包括ECS、网络、存储等核心组件;设计支持海量资源(十万级节点)的管理与调度体系;主导系统从0到1的落地:架构设计、核心开发、上线与持续演进;构建高可用运维体系,涵盖发布、变更、监控、故障处理与自动化
大模型推理引擎开发工程师
参与分布式大模型推理框架的开发与优化,提升推理性能与吞吐量;针对不同场景的LLM请求特点,优化GPU计算流程,打造业内领先的高效LLM推理引擎;调研并引入前沿机器学习系统技术,推动系统架构的持续优化升级
AI Coding / Coding Agent 全栈开发工程师
负责AI Coding / Coding Agent产品方向的设计与全栈开发;定义Agent在真实研发场景中的工作流、交互方式与任务执行逻辑;与算法团队深度协同,推动模型能力快速产品化与体验迭代
算法数据平台架构师
负责算法数据平台系统的架构设计和开发工作,保障系统稳定、高效、安全;深入发掘和分析算法团队的数据需求,设计合理的技术方案并实现;持续对系统平台进行架构改造和优化,提升系统的稳定性与可扩展性
大语言模型多模态Agent系统架构师
设计并实现基于大语言模型(LLM)的多模态Agent系统架构,支持多轮对话、工具调用、任务规划与执行;集成外部工具、API、Agent Skills(搜索、数据库、代码执行等),扩展Agent能力边界
数据平台工程师
搭建和完善数据仓库,设计数据模型与分层架构,沉淀公司数据资产,为算法训练和业务分析提供可靠的数据基座;建设和维护数据平台产品(数据分析平台、数据集管理平台、DataAgent等),推动数据治理,提升数据使用效率
Agent训推框架与实验平台工程师
负责Agent训练与推理全链路框架的开发、优化与稳定性保障,支撑大规模模型训练实验的高效运转;设计并维护Agent执行沙箱,保障代码执行、工具调用等复杂场景下的安全性、隔离性与可靠性
高级数据采集工程师
参与数据团队数据采集平台的架构设计和开发工作;负责设计和开发分布式网络爬虫系统,并进行技术选型;持续对系统进行架构改造和优化,提升系统的稳定性与可扩展性,保障系统稳定、高效、安全运行;负责多平台信息(视频、音频、图片、文章等)的采集
数据平台工程师
负责通用数据与Agent数据平台建设,覆盖数据采集、生产、清洗、评测与回流全链路;搭建高稳定性Pipeline、数据工具链与Workflow,支撑算法训练、评测与实验迭代;建设数据质量治理、资产管理与可观测体系,持续提升数据一致性、可追溯性与生产效率
大模型强化学习训练与推理系统工程师
负责强化学习训练与推理基础设施的设计、开发与优化;负责分布式训练、任务调度、权重同步、热更新等核心链路建设;持续优化系统性能,包括吞吐量、时延、GPU利用率、训练效率等指标;建设稳定性与可观测能力,定位并解决OOM、超时、通信瓶颈、一致性问题等
大模型训推系统工程师
维护并持续优化Post-Train训推框架,降低使用门槛,让研究员专注于实验本身而非环境问题;深入训练与推理全链路,覆盖显存优化、通信加速、调度策略、吞吐与延迟等核心指标,缩短实验周期,提升资源利用率
深度学习训练框架研发工程师
负责深度学习训练框架研发,包括框架的内核开发、算子适配、功能迭代及性能优化,定位并修复框架底层问题;负责大模型分布式训练系统研发,设计并优化数据并行、张量并行、流水线并行、序列并行、专家并行、ZeRO/FSDP等并行策略,提升超大规模模型训练效率
大语言模型基础设施工程师
负责大语言模型训练基础设施的设计与开发,包括大规模数据加载优化、训练数据构建和数据处理流水线;负责大规模训练数据格式与存储方案设计,优化数据输入输出和分布式训练场景下的数据吞吐能力;负责模型工具链建设,包括模型格式转换、权重切分与合并、跨框架模型迁移
高管内容策划与社媒运营
负责高管的整体内容策划与日常社媒账号运营;输出具备传播力的内容,包括AI/大模型行业观察、硅谷趋势与热点解读、创业者观点表达、产品思考、技术趋势和个人表达;跟踪AI、科技、互联网、硅谷等领域热点,快速完成选题与内容响应
大模型开放平台后端开发工程师
负责大模型开放平台的整体架构设计与核心模块研发,包括API Gateway、模型路由、流量调度、多租户隔离等,确保系统高可用、高并发与可扩展;设计并实现统一的模型调用协议与接入标准,支持多模型(自研/三方)的统一接入、版本管理、灰度发布与流量切换,对外提供标准化的API/SDK
个人/工作智能体研究员
探索基于人机协同的高质量工作流数据挖掘与合成,构建多步骤、跨应用、长周期的复杂工作任务数据,以加强智能体的规划和多工具编排能力;构建WorkingAgent的基础能力,包括任务分解与规划、多工具协同调用、上下文管理与信息整合、自主纠错与迭代执行能力
相机应用工程师
负责相机APP功能模块的开发工作,确保功能符合产品设计要求与用户体验预期;参与手机相机客户端基础框架研究、设计和实现,关键技术的选型和验证工作;负责优化相机APP的性能表现、内存占用及功耗,提升用户体验
Android认证工程师
制定Android产品(手机/平板)的CTS/VTS/GTS/GSI等认证测试计划,评估测试范围、资源与风险;主导执行全流程的认证测试,包括CTS、VTS、GTS和GSI测试;对认证测试中发现的FAIL项和ERROR项进行根因分析,准确定位问题模块
产品经理
负责公司LLM产品规划与落地,包括产品定义、模型效果优化、用户体验提升;驱动算法、数据、评估团队协同,把控数据质量与模型迭代方向,持续提升模型在真实场景中的表现;深入分析用户需求与使用场景,探索大模型技术在C端/B端产品中的创新应用
多模态预训练数据研究员/算法专家
主导多模态大模型预训练数据的生产与质控体系建设,覆盖采集、解析、合成、清洗、配比全链路,规模达万亿token量级;以数据为中心的方法量化数据与模型能力的因果关系,设计配比与采样策略,通过对照实验沉淀可复现结论
数据平台高级架构师
负责通用数据与Agent数据平台建设,覆盖数据采集、生产、清洗、评测与回流全链路;搭建高稳定性Pipeline、数据工具链与Workflow,支撑算法训练、评测与实验迭代;建设数据质量治理、资产管理与可观测体系,持续提升数据一致性、可追溯性与生产效率
数据标注项目运营实习生
负责对图像类数据的标注/评测项目,保证交付数据的质量,质检验收内外部标注团队的标注结果;参与需求拆解、任务下发、进度跟踪与质量反馈闭环,支持图像编辑类标注的专业沟通与样本管理;协助任务分派、进度监控、产出收集与整理,维护任务看板与文档版本,确保项目的顺利交付
基础设施工程师(大模型方向)
负责分布式训练系统的设计与优化;参与推理优化、训练框架、RL系统、平台和网络等方向的研发工作;支持大规模分布式系统和云原生/K8s环境的搭建与维护;进行CUDA/GPU编程、性能优化或分布式训练加速技术的应用与改进
强化学习推理优化系统工程师
负责强化学习训练与推理基础设施的设计、开发与优化;负责分布式训练、任务调度、权重同步、热更新等核心链路建设;持续优化系统性能,包括吞吐量、时延、GPU利用率、训练效率等指标;建设稳定性与可观测能力,定位并解决OOM、超时、通信瓶颈、一致性问题等
高级推理平台工程师(推理云平台infra)
负责推理云平台核心系统的架构设计与关键模块开发,建设服务控制面、配置管理、发布变更、运行治理等平台能力;面向大规模IDC与云上环境,设计和演进平台基础设施架构,提升系统在复杂部署场景下的稳定性、扩展性与可运维性
大模型AI Coding实习生
建设并优化LLM/Agent评测平台,形成实验、评测、回归与数据闭环;设计和优化AI Coding产物评估标准,对生成的前端页面、组件、工具等进行多维度质量评估;参与LLM训练数据建设,包括编码任务设计、数据合成、数据清洗、质量筛选与问题归因
LLM 预训练主训研究员
负责千卡以上规模预训练任务的日常运维与异常处理,保障训练零中断或快速恢复;诊断并解决loss spike、梯度爆炸、NaN、慢节点等训练异常,建立系统化的问题分类与处理机制;优化训练吞吐(MFU),通过kernel融合、通信隐藏、梯度checkpoint等手段提升GPU利用率
相关搜索词
这些词用于覆盖真实搜索需求,也方便用户继续定位公司、城市、岗位方向和薪资信息。