DataHub 关键词情报 · 数据更新至 2026-07-22
深圳AI招聘信息
本页整理深圳地区AI行业相关岗位,帮助用户快速判断当地机会密度、活跃公司和主要岗位方向。
活跃公司
- 腾讯85 · 30.1%
- 面壁智能59 · 20.9%
- 摩尔线程42 · 14.9%
- 寒武纪33 · 11.7%
- 智谱AI24 · 8.5%
- 商汤科技11 · 3.9%
- 阶跃星辰8 · 2.8%
- 小米4 · 1.4%
- 壁仞科技4 · 1.4%
- 百度4 · 1.4%
热门地点
- 深圳282 · 100.0%
岗位方向
- 算法与研究118 · 41.8%
- 工程与基础设施114 · 40.4%
- 其他岗位29 · 10.3%
- 产品与运营15 · 5.3%
- 销售与客户4 · 1.4%
- 职能与支持2 · 0.7%
OPEN ROLES
代表岗位
资深AI系统工程师
参与银行项目的前期技术方案设计与整体系统架构设计,包括应用架构、部署架构、数据链路、模型与服务集成等;负责技术选型,主要技术栈为Golang、Python、Java;对项目方案进行工程拆解,输出模块划分、系统边界和接口设计
感知算法工程师
负责无人机/机器人感知模型的研发、训练与优化,聚焦多传感器融合、目标检测与跟踪、场景理解等方向,探索多模态大模型及端到端感知算法;负责训练数据体系建设,包括数据采集、清洗标注、样本构建、难例挖掘及仿真数据生成,持续优化数据质量与模型效果
端侧大模型算法专家
面向Agentic OS,参与端侧大模型架构设计与训练、训推一体的端侧大模型新架构探索落地与跨场景执行能力的系统级Agent算法体系建设;目标为通过算法与硬件的协同设计,在极小的功耗和内存预算下,实现极致的模型性能
行政专员
负责所在区域行政综合服务工作;负责办公环境巡检、监督、维护工作;负责工位、办公资产管理与盘点;负责第三方供应商对接与管理;根据年度行政预算,做好所辖业务线成本分析与费用管控;负责所辖业务线费用与票据处理
高级审计经理
执行全业务审计项目,包括制定审计计划与策略、现场实施、取证与报告,揭示内控缺陷和舞弊隐患,促进内控改进闭环;评估内控设计与执行的有效性,参与内控制度、流程和标准的建设与优化;开展经济舞弊风险核实、投诉调查和舞弊线索查证,进行证据固定、结论报告和问责建议
具身智能数据基础设施工程师
设计多源异构数据采集管线,对接遥操作、人手动捕、外骨骼、仿真等不同数据源,完成从原始传感器数据到可训练格式的全链路;构建数据处理与增强算法,包括视觉域适配(人手→机器人手 inpainting)、异常轨迹检测与清洗、多模态对齐(RGB + 深度 + 触觉 + 关节角 + 力矩)
大模型算法实习生
参与大模型的研究和应用,包括但不限于LLM、SFT、Agent/MultiAgent、Tool Learning、RAG、RLHF等技术探索,研究前沿模型训练和优化方法,开发国际顶尖级大模型
现场技术支持工程师
负责支持GPU服务器整机硬件系统设计,包括需求分析、硬件评估、方案设计、硬件选型、性能评估等,确保GPU服务器满足业务需求和技术竞争力;负责支持GPU服务器硬件开发全过程,与OEM厂商及内外部资源紧密协作,进行硬件详细设计、开发调测、生产导入及量产维优工作,确保服务器硬件成本、质量、开发效率达成目标
大模型推理框架开发工程师
基于壁仞GPU软件栈,开发大模型和多模态大模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩等方面,持续优化大语言模型推理性能,降低模型推理延迟,提升线上模型服务吞吐;硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业,三年及以上相关工作经历
大模型强化学习研发实习生
研究基于Long Chain of Thought的大模型强化学习相关技术,包括算法或系统实现;探索推理能力(Reasoning)方向的算法突破;探索智能体(Agent)方向的技术创新
代理研发工程师(J93903)
优化检索增强生成(RAG)场景中大型语言模型(LLM)的管道和模型性能;探索和开发LLM在多模态任务、函数调用和交互式搜索中的高级应用;跟踪RAG、多模态代理和函数调用中大型语言模型评估能力的最新进展,并建立系统评估能力
AI智能体工程师
负责构建Coding Agent评估体系,建立多行业测试用例库;通过CI/CD报告及埋点数据持续监控效果;主导Prompt工程优化工作,开发垂直领域动态Prompt模板;迭代提示词策略,降低幻觉率并提升需求解析精度
前沿部署工程师
方案设计: 洞察行业机会点,将公司大模型技术、Agent框架转化为具备竞争力的商业化解决方案。需对方案的商业可行性、ROI及市场竞争力负责;端到端交付: 负责AI项目从POC到正式交付的全生命周期管理。解决落地过程中的架构瓶颈,确保解决方案在商用场景下的性能达标
大客户成功高级经理(深圳)
支持销售团队面向客户介绍专业服务体系,收集、分析大客户复杂场景下的需求,推动商机进度和需求落地;作为售后阶段的主要owner对接客户,深入了解客户业务场景,总结产品在客户实际场景使用的实践
存储运维开发工程师
负责分布式存储系统的SRE工作,包括监控、容量规划、故障响应、系统优化等;设计和实现自动化运维工具,提升系统稳定性和运维效率;参与存储系统的架构优化,提高系统性能、可扩展性和高可用性;进行故障分析和根因排查,提升存储系统的可靠性
数据分析师(银行)
负责项目中数据接入、清洗、加工、建模等全链路开发工作;使用Hive/SQL进行数据处理、指标加工和统计分析;参与信贷风控模型指标体系建设,完成指标评价及数据支持工作;配合业务、算法及客户团队,推进项目各阶段实施与交付
Android底层稳定性工程师
负责Android设备底层稳定性保障,聚焦内核、HAL、底层系统服务及驱动模块,解决系统级崩溃、异常重启、功能失效等核心问题,提升设备长期运行可靠性;构建底层稳定性指标体系与监控平台,制定关键指标基线,通过实时监控与趋势分析提前发现潜在风险
手机软件项目经理
负责手机软件项目开发的整个过程,包括从项目启动阶段到量产阶段,以及EWP售后维护阶段;带领项目团队识别并消除风险,进行流程优化和提高业务效率;协助跨职能部门间沟通管理,拉起各个团队梳理问题,明确解决方案,持续提升跨组织协作效率以推动业务目标达成
新产品导入工程师
负责新产品导入(NPI)过程中的资源协调及进度跟进;参与产品制造过程中的问题分析及解决,确保产品质量符合标准;拉通各职能部门进行生产流程的改进,提高生产效率和良率,保障爬坡量产以及量产交付
嵌入式系统软件工程师
负责主控芯片(基于ARM Cortex-M/R/A系列或同等性能替代芯片)的嵌入式系统软件整体架构设计、搭建与实现;负责从零开始或深度定制Bootloader、板级支持包,并完成底层硬件抽象层驱动的开发与移植
机器人运动控制算法工程师
负责多自由度机械臂/高动态腿足机器人运动控制算法的设计、开发、仿真验证与落地应用,涵盖运动学正逆解、动力学建模与补偿、轨迹规划、伺服控制等核心模块;搭建并优化机械臂/腿足机器人仿真环境,开展算法离线仿真测试、参数调优及性能验证,保障算法稳定性与可靠性
多模态大模型算法工程师
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练,涉及模型高效结构、多模态scaling law、数据配比、性能优化等探索;参与多模态大模型的训练加速和高效部署,包括但不限于系统调优、硬件适配等工作
多模态大模型分布式训练与推理工程师
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
多模态大模型强化学习算法工程师
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
语音大模型研发工程师
负责语音方向(ASR / TTS)大模型的研发与应用,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用;深入调研音频和大模型领域前沿技术,参与语音大模型前沿技术研发
语音大模型算法专家
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进最新技术,通过技术创新和工程实践支撑模型能力提升
多模态大模型数据科学家
构建核心数据引擎:主导多模态大模型在预训练、指令微调、偏好对齐等全阶段的数据体系建设,攻克海量多模态语料的智能采集、多维清洗、去重过滤、自动化标注与深度挖掘等核心技术壁垒;驱动“数据-模型”飞轮迭代:建立数据合成与构造、模型训练、能力评测的全链路闭环验证体系,通过精准的数据消融与归因分析,确保数据…
多模态大模型研究员
参与MiniCPM-o多模态模型的音视频联合理解能力建设,包括音频理解、视频理解、音视频联合理解等方向;参与全模态全双工大模型的研发,包括主动提醒、边看边说、打断处理等全双工特色能力
多模态长上下文模型训练工程师
负责 MiniCPM-o 在长视频、长音视频上下文、长文本场景下的模型训练与效果优化;建设长上下文训练数据链路,处理长视频训练数据并确保稳定训练;参与长上下文全模态模型训练策略设计,包括数据配比和长序列稳定训练优化
全模态全双工模型评测工程师
负责MiniCPM-o全模态全双工模型的评测系统建设,覆盖ASR、VoiceBench、OmniBenchmark、FullDuplex Bench、LiveSports等任务;建设自动化评测流水线和评测框架的设计、维护与重构,维护评测可用性、结果可视化工具和badcase分析工具
嵌入式AI开发工程师
负责瑞芯微平台(RK3566/RK3576/RK3588)的NPU模型部署与优化;完成端侧大模型的全流程部署,包括模型量化、格式转换(ONNX等)及NPU推理加速;使用C/C++或Python进行嵌入式应用开发,处理多线程与网络编程任务
Agent沙盒平台研发工程师
构建和维护可扩展的Agent沙盒环境,覆盖代码执行、命令行、浏览器/GUI、隔离workspace等形态,支撑评估、测试及后续业务扩展;建设Agent沙盒统一托管与调度平台,提供创建、调度、回收与基础监管能力
大客户销售经理(AI大模型)
负责智谱AI大模型产品在《财富》全球500强跨国企业中的业务拓展,加速跨国企业的生成式AI转型进程,提供一系列生成式AI解决方案咨询服务,与客户建立长期可持续的战略合作伙伴关系;制定详细、可执行的销售策略,协同营销、产品开发等内部资源及外部合作伙伴能力,聚焦赋能客户成功,核心是达成业绩目标
Android认证工程师
制定Android产品(手机/平板)的CTS/VTS/GTS/GSI等认证测试计划,评估测试范围、资源与风险;主导执行全流程的认证测试,包括CTS、VTS、GTS和GSI测试;对认证测试中发现的FAIL项和ERROR项进行根因分析,准确定位问题模块
Agent 架构师
设计并演进 Agent Harness,包括运行时编排、工具调用、上下文与执行环境,支撑编码、搜索等 Agent 的后训练与应用落地;设计 Agent-to-Agent(A2A)协作与任务分解方案,满足生产环境的可靠性、安全与可观测性
技术雇主品牌运营
负责大模型前沿技术成果与技术人才成长的内容产出,包括但不限于文章、图片、视频等形式;提炼并发布具有传播度与品牌可塑性的AI技术/人才话题;通过开拓并维护内外部技术人才与品牌渠道,扩大公司在技术人才招聘上的知名度与影响力
Agent 沙盒工程师
构建和维护可扩展的 Agent 沙盒环境,覆盖代码执行、命令行、浏览器/GUI、隔离 workspace 等形态,支撑评估、测试及后续业务扩展;建设 Agent 沙盒统一托管与调度平台,提供创建、调度、回收与基础监管能力
自动化工具研发工程师
负责GPU板级产品研发及测试过程中的自动化工具、PC端上位机软件、测试工具的设计与开发;搭建和维护GPU板级产品的自动化测试框架(HIL/SIL),实现从代码构建、固件烧录、功能测试到报告生成的全流程自动化
超节点产品经理
负责超节点计算节点、网络节点硬件关键部件的技术追踪与产品管理,涵盖CPU、内存、SSD、网卡、交换芯片等核心组件;基于最新关键硬件部件,定义新型AI训练及推理的系统级产品;追踪并分析关键硬件部件市场趋势与技术动态
产品工艺工程师
负责产品整机、单板的NPI全流程管理,制定项目计划,组织DFM/DFT评审,管控试产、问题闭环及量产保障全环节;设计、优化生产工艺方案,管控ECN工艺变更落地;建立产品生产工艺路线,主导生产夹治具开发及导入使用
PCB工程师
负责产品测试装置和应用系统的硬件板卡PCB设计工作;根据元器件规格书绘制元件封装并整理、维护公司器件封装库;与结构工程师、热设计工程师和硬件工程师确认PCB设计规则;与PCB加工厂进行文件确认,并跟踪PCB的打样周期
固件开发工程师
负责Cortex-M内核单片机固件开发工作;负责定位和解决固件相关问题;熟悉C语言,熟悉gcc开发环境;熟悉STM32、GD32等单片机的工作原理,具备相应固件开发经验;熟悉I2C、SPI、UART、DMA等常用接口和外设
训练优化高级工程师
负责大模型预训练加速算法的研究与优化,涵盖MoE、多模态、创新架构等核心方向;针对MoE架构进行专项优化,解决Expert并行、负载均衡、通信优化等关键技术问题;研究并优化多模态模型(Vision-Language、Audio-Language等)的训练效率
嵌入式系统工程师
基于瑞芯微平台(RK3566/RK3576/RK3588)进行嵌入式Linux系统开发与NPU模型部署;负责端侧大模型部署全流程,包括模型量化、格式转换(ONNX等)及NPU推理加速
强化学习架构师/工程师-Infra方向
基于现有强化学习算法框架,建设并部署支撑RL训练的高效稳定基础设施;优化强化学习训练流程与框架,持续提升训练效率和模型性能;与团队协作,推动Infra方案落地,保障强化学习模型的高效训练
强化学习架构师/工程师-Infra方向
基于现有强化学习算法框架,建设并部署支撑RL训练高效稳定运行的基础设施;优化强化学习训练流程与框架,持续提升训练效率和模型性能;与团队协作推动Infra方案落地,保障强化学习模型的高效训练
Android系统开发工程师
负责Android Framework层开发与定制,包括ActivityManager、WindowManager、InputManager、Sensor、指纹人脸等核心模块的模块开发、功能定制和性能优化
集群系统架构
负责智算超算集群系统的架构设计与方案规划;深入理解计算、存储、网络的组合配比以发挥最大性能;为互联网及OEM客户设计GPU云厂商智算超算解决方案;对接曙光、华为云等主流平台完成方案落地;5-10年相关工作经验
AI集群网络解决方案与服务工程师
负责AI算力集群网络方案设计与实施交付,包括GPU训练网络架构设计(RoCE/IB/100G/200G/400G)、管理网络/存储网络/训练网络规划及ToR/Spine架构设计;负责AI集群网络环境部署与调试,包括交换机配置与上线、VLAN/VXLAN/BGP/ECMP配置及RDMA/RoCE网络…
大客户销售(SOC/互联网方向)
负责GPU产品在战略客户(如运营商、金融、互联网、能源电力、政府机构、科研、高教等行业)的销售,开展产品推广、销售工作,完成销售目标;负责对客户在AI大模型、算力中心、云桌面、视频渲染、视频仿真、数字孪生等应用场景进行国产化业务拓展和挖掘
Agent开发工程师
基于主流大模型(如Qwen、DeepSeek、SenseNova等)设计并开发AI Agent,解决真实业务问题;负责Agent核心能力开发,包括任务规划、工具/API调用、记忆机制(RAG)与结果校验
售前解决方案工程师
负责壁仞产品POC和送测,向客户介绍产品解决方案并理解客户需求;深入理解客户AI场景需求(如大模型训练、边缘推理、工业质检等),主导设计基于国产AI芯片的软硬一体化解决方案;编写技术方案书、投标文件及POC测试方案,支撑销售完成项目签约
深度学习框架图编译工程师
优化Torch Compile模式下各类神经网络的性能,包括网络性能瓶颈分析、编译耗时优化及codegen性能优化等;紧跟PyTorch社区最新技术进展,及时将前沿性能优化技术迁移到MLU平台
深度学习框架图编译工程师
优化Torch Compile模式下各类神经网络的性能,包括网络性能瓶颈分析、编译耗时优化、codegen性能优化等;紧跟PyTorch社区最新技术进展,及时将前沿性能优化技术迁移到MLU平台,保持技术竞争力和创新性
深度学习框架图编译工程师
优化Torch Compile模式下各类神经网络的性能,包括网络性能瓶颈分析、编译耗时优化、codegen性能优化等;紧跟PyTorch社区最新技术进展,及时将前沿性能优化技术迁移到MLU平台
PCB设计工程师
负责产品测试装置和应用系统的硬件板卡PCB设计;根据元器件规格书绘制元件封装并整理、维护公司封装库;与结构工程师、热设计工程师和硬件工程师确认PCB设计规则;与PCB加工厂家进行文件确认,并跟踪PCB的打样周期
深度学习框架图编译工程师
优化Torch Compile模式下各类神经网络的性能,包括网络性能瓶颈分析、编译耗时优化、codegen性能优化等;紧跟PyTorch社区最新技术进展,及时将前沿性能优化技术迁移到MLU平台,保持技术竞争力和创新性
结构设计工程师
负责结构设计的前期技术可行性分析;拟制结构设计方案和项目计划,研究开发新技术,提升产品性能和质量;承担结构零部件的详细设计、公差分析、DFMEA检查、样机验证和生产文件编制;配合上下游部门完成PCB布局设计、连接器选型、散热设计、线束设计及安装指导等
AI硬件应用工程师
为寒武纪MLU硬件系统提供专业的技术支持和培训服务;围绕MLU产品硬件与质量等相关需求进行收集和提炼,推动内部研发进行开发和完善,并进行验收;支撑寒武纪MLU硬件系统的应用和维护,对产品故障、性能、互联等问题进行分析、定位和解决
多模态训练加速研发工程师-infra
负责大规模分布式训练和推理的基础架构设计、开发与优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈
语音大模型算法专家
主导语音大模型的前沿算法研究及产业落地工作;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,对领域最新技术进行及时吸纳和改进,通过技术创新和工程实践支撑模型能力提升
多模态强化学习算法工程师
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;开展多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
大模型算法工程师-行业应用
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等技术方向;探索前沿训练与优化方法,持续提升模型性能与效率;基于业务场景设计模型微调方案及算法/系统解决方案,推动模型落地应用
多模态数据算法工程师
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,涵盖数据采集、数据入库、数据清洗、数据观测与数据挖掘等全环节;负责多模态数据的闭环验证,建立从数据构造、模型训练到性能评测的全链路闭环体系,确保数据有效提升模型基础能力
视频设计师
负责技术成果发布的官方传播视频制作,通过动效、动画设计等手段包装技术与产品的亮点,发布在海内外不同平台上;负责开发者使用与部署教程、产品功能使用引导等视频内容的剪辑包装;具备基础平面设计能力,能够创作符合科技行业需求的视觉内容,包括海报、品牌物料、UI辅助设计等
大模型应用算法工程师-语音方向
负责语音方向(ASR/TTS)大模型的研发与应用,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用;跟踪前沿技术动态,探索AI在公共服务、民生场景中的智能化与普惠化应用
具身智能数据算法工程师
设计多源异构数据采集管线,对接遥操作、动捕、外骨骼、仿真等不同数据源,完成从原始传感器数据到可训练格式的全链路;构建数据处理与增强算法,包括视觉域适配、异常轨迹检测与清洗、多模态对齐(RGB、深度、触觉、关节角、力矩等)
海外销售解决方案专家(出差新加坡)
深入研究海外目标市场(中东、欧洲、东南亚、拉美等)的行业痛点,结合面壁智能大模型及Agent标杆案例,打造具备国际竞争力的销售解决方案,主动驱动海外业务营收增长;紧密配合海外销售团队,主导与全球客户及合作伙伴的技术交流、商务谈判及POC验证;负责海外大标项目的招投标方案撰写,精准匹配技术价值与商业…
语音大模型算法工程师-语音应用
参与VoxCPM语音大模型研发,负责语音模型能力研发和效果提升;探索语音大模型在实际场景中的应用落地,解决应用落地过程中的前沿问题;深入调研音频和大模型领域前沿技术,参与语音大模型前沿技术研发
图形渲染/3DGS算法工程师
主导3D高斯泼溅(3DGS)算法的研究、实现及在显卡平台的性能优化,推动实时渲染与动态场景重建技术落地;开发基于扩散模型、多模态等框架的视频/图像生成算法,支持多模态内容生成(如文生视频、图生3D等)
高级系统验证工程师
对板级电源完整性与高速信号链路(如PCIe、DP、HDMI、GDDR等)进行信号完整性分析、测试验证与问题深度调试,使用示波器、负载仪、相噪仪等专业设备定位并解决反射、串扰、损耗、噪声等问题
大模型Infra/算法工程师
负责超大规模GPU集群分布式训练技术的研究与实现,提升MOE大模型和强化学习的训练吞吐;开展大模型前沿算法的调研与实现工作;进行大模型训练框架和推理框架的研发与性能调优;熟悉Python或C++,具备扎实的算法和计算机基础、良好的编程风格
硬件设计工程师
设计基于FPGA、CPU、GPU、SoC、MCU等的工程验证板以及量产产品;根据需求完成原理图的设计,对关键元器件关键参数的计算、评估和选定;协助PCB的布局、布线,BOM表的生成和维护
AI软件性能优化工程师/专家
参与改善AI场景下全链路的性能表现;深度理解系统性能瓶颈;结合上层业务/算法、软件、硬件等各层面进行优化;输出具备极致竞争力的产品结果;不限学历、专业、背景;至少具备以下能力的两种:良好的C++开发功底;对硬件体系结构的深刻理解;程序算法设计能力
大模型预训练算法工程师
负责生成式大模型预训练数据的建设和管理、大模型的预训练和后训练;负责数据合成、模型训练和分析等全链路的大模型训练研发工作,提升大模型预训练/后训练效果;跟进业界最新技术及进展,结合实际场景应用创新并在系统中进行落地
机器学习研究员-视觉方向
基于深度学习开发计算机视觉算法,方向包括图片识别与处理、视频理解、生成模型、多模式融合、3DGS;参与指导数据的采集、标注、预处理,负责视觉模型训练与评估,协助模型部署;在多种计算环境下提高模型训练和推理过程的效率
大模型预训练算法工程师
负责预训练的数据工作,包括数据合成、数据清洗、数据理解、数据实验等全链路的数据研发工作;提升大模型预训练效果;跟进业界最新技术及进展;结合实际场景应用创新并在系统中进行落地;计算机、数学、机器学习或相关专业硕士以上学历
深度学习框架/分布式训练工程师
参与主流机器学习框架与摩尔线程软硬件栈的对接、模型优化和部署工作;参与机器学习单GPU以及分布式训练技术的研究与实现,包括各种并行与异构计算技术的设计、开发与性能优化;研究并实现适合摩尔线程自研GPU的模型优化和压缩方法
大模型算法工程师(训练方向)
负责生成式大模型预训练数据的建设和管理、大模型的预训练和后训练;负责数据合成、数据清洗、数据理解、数据实验等全链路的数据研发工作,提升大模型预训练效果;跟进业界最新技术及进展,结合实际场景应用创新并在系统中进行落地
AI基础设施工程师
参与万卡GPU集群分布式训练系统开发,提升集群训练性能并进行理论分析;研究并实现单卡及分布式训练并行与异构计算技术,持续优化性能;结合分布式训练技术,探索并优化前沿语言/多模态大模型算法与适配方案
相关搜索词
这些词用于覆盖真实搜索需求,也方便用户继续定位公司、城市、岗位方向和薪资信息。