具身智能数据工程师
设计多源异构数据采集管线,对接遥操作、人手动捕、外骨骼、仿真等不同数据源,完成从原始传感器数据到可训练格式的全链路;构建数据处理与增强算法,包括视觉域适配(人手→机器人手 inpainting)、异常轨迹检测与清洗、多模态对齐(RGB + 深度 + 触觉 + 关节角 + 力矩)
AI行业岗位
面壁智能是一家大模型创业公司,聚焦高效大模型、端侧与企业级模型应用,并围绕模型训练、推理和智能体场景建设产品能力。在业务特点上,面壁智能更强调技术研发与产品落地的结合:一方面需要持续推进模型、算法、数据、算力和工程平台等基础能力,另一方面也要把 AI 能力转化为稳定可用的产品、工具或行业解决方案。这类公司的竞争力通常来自高密度研发团队、快速迭代的工程体系、对真实应用场景的理解,以及从基础研究到商业化交付的协同能力。从团队建设看,相关方向主要集中在模型算法、工程平台、产品应用、数据与算力等领域,适合关注前沿技术、复杂系统、产品化能力和长期产业机会的人持续观察。整体来看,公司价值不只体现在单点技术突破,也体现在持续吸引高水平人才、沉淀工程方法、连接生态伙伴并把能力规模化交付的综合实力。
面壁智能招聘页会持续整理岗位职责、工作地点、薪资标注和岗位方向,适合通过搜索了解面壁智能最新招聘机会。
OPEN ROLES
设计多源异构数据采集管线,对接遥操作、人手动捕、外骨骼、仿真等不同数据源,完成从原始传感器数据到可训练格式的全链路;构建数据处理与增强算法,包括视觉域适配(人手→机器人手 inpainting)、异常轨迹检测与清洗、多模态对齐(RGB + 深度 + 触觉 + 关节角 + 力矩)
设计多源异构数据采集管线,对接遥操作、人手动捕、外骨骼、仿真等不同数据源,完成从原始传感器数据到可训练格式的全链路;构建数据处理与增强算法,包括视觉域适配(人手→机器人手 inpainting)、异常轨迹检测与清洗、多模态对齐(RGB + 深度 + 触觉 + 关节角 + 力矩)
主导汽车行业大模型商业化项目全流程管理,建立项目管控体系,把控进度、质量、成本,确保项目按时按质按预算交付,规避项目风险;联动销售、市场、研发等多团队,制定大模型产品商业化推广策略,推动产品在主机厂、Tier1供应商等客户群体落地与复购
负责大语言模型、多模态模型的推理引擎搭建、优化与线上落地,支撑高并发、低延迟的模型服务;基于 vLLM、TensorRT-LLM、SGLang、LightLLM 等主流推理框架进行性能调优,并探索推测性解码、前缀缓存等前沿加速技术
负责公司大模型训练引擎的研发,将算法逻辑高效转化为大规模分布式系统实现;在千卡/万卡规模集群上,针对NVIDIA H系列或国产算力优化NCCL/HCCL通信策略,极致提升集群的MFU
负责端侧LLM/ASR/TTS等各类模型的推理引擎选型、适配与性能优化;持续优化推理速度:量化(INT4/INT8)、KV Cache优化、speculative decoding、FlashAttention等
围绕硬件产品,协助制定内容策划方案,向海外用户清晰、有吸引力地讲述产品故事;深入理解AI硬科技产品的核心价值,输出符合不同市场用户认知习惯的内容;结合海内外市场的内容消费习惯,制定差异化的内容表达策略
参与模型训练,构造在高性能/基础设施侧专用的模型;构建统一的训练Harness范式,标准化训练、基准测试与评测流程;探索Agentic Infra,将训练系统从人工驱动升级为Agent驱动
负责AI算力调度平台核心服务的设计、开发与持续演进,支撑模型训练、研发调试、镜像管理、数据流转等关键场景;基于Kubernetes/Volcano构建资源管理、项目配额、任务调度、队列治理、优先级与抢占等核心能力,持续提升GPU资源利用率与平台吞吐能力
负责VLA/VA模型训练,探索具身数据大规模预训练方法;优化Action数据动作表示和监督方法,探索具身模型scaling law,在真机任务上形成可量化的成功率收益;负责动作表示与生成策略,并在真机任务上形成可量化收益
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练,涉及模型高效结构、多模态Scaling Law、数据配比、性能优化等探索;参与多模态大模型的训练加速和高效部署,包括但不限于系统调优、硬件适配等工作
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练,涉及模型高效结构、多模态scaling law、数据配比、性能优化等探索;参与多模态大模型的训练加速和高效部署,包括但不限于系统调优、硬件适配等工作
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练,涉及模型高效结构、多模态scaling law、数据配比、性能优化等探索;参与多模态大模型的训练加速和高效部署,包括但不限于系统调优、硬件适配等工作
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练,涉及模型高效结构、多模态scaling law、数据配比、性能优化等探索;参与多模态大模型的训练加速和高效部署,包括但不限于系统调优、硬件适配等工作
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;进行多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;进行多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进最新技术,通过技术创新和工程实践支撑模型能力提升
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进最新技术,通过技术创新和工程实践支撑模型能力提升
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进最新技术,通过技术创新和工程实践支撑模型能力提升
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;进行多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责语音方向(ASR / TTS)大模型的研发与应用,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用;深入调研音频和大模型领域前沿技术,参与语音大模型前沿技术研发
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进最新技术,通过技术创新和工程实践支撑模型能力提升
负责端侧大模型在办公、具身智能、医疗、遥感、思维博弈、电磁信号等垂直领域的解决方案设计;具备大模型预训练、微调等基础知识,针对客户需求完成模型选型、数据策略制定及微调方案设计;熟练运用Vibe Coding范式,借助自然语言驱动的高效编码方式快速生成、迭代和调试代码原型
构建核心数据引擎:主导多模态大模型在预训练、指令微调、偏好对齐等全阶段的数据体系建设,攻克海量多模态语料的智能采集、多维清洗、去重过滤、自动化标注与深度挖掘等核心技术壁垒;驱动“数据-模型”飞轮迭代:建立数据合成与构造、模型训练、能力评测的全链路闭环验证体系,通过精准的数据消融与归因分析,确保数据…
构建核心数据引擎:主导多模态大模型在预训练、指令微调、偏好对齐等全阶段的数据体系建设,攻克海量多模态语料的智能采集、多维清洗、去重过滤、自动化标注与深度挖掘等核心技术壁垒;驱动“数据-模型”飞轮迭代:建立数据合成与构造、模型训练、能力评测的全链路闭环验证体系,通过精准的数据消融与归因分析,确保数据…
构建核心数据引擎:主导多模态大模型在Pre-training、SFT、RLHF等全阶段的数据体系建设,攻克海量多模态语料的智能采集、多维清洗、去重过滤、自动化标注与深度挖掘等核心技术壁垒
构建核心数据引擎:主导多模态大模型在Pre-training、SFT、RLHF等全阶段的数据体系建设,攻克海量多模态语料的智能采集、多维清洗、去重过滤、自动化标注与深度挖掘等核心技术壁垒
参与 MiniCPM-o 多模态模型的音视频联合理解能力建设,包括音频理解、视频理解、音视频联合理解等方向;参与全模态全双工大模型的研发,包括主动提醒、边看边说、打断处理等全双工特色能力
参与MiniCPM-o多模态模型的音视频联合理解能力建设,包括音频理解、视频理解、音视频联合理解等方向;参与全模态全双工大模型的研发,包括主动提醒、边看边说、打断处理等全双工特色能力
参与MiniCPM-o多模态模型的音视频联合理解能力建设,包括音频理解、视频理解、音视频联合理解等方向;参与全模态全双工大模型的研发,包括主动提醒、边看边说、打断处理等全双工特色能力
参与 MiniCPM-o 多模态模型的音视频联合理解能力建设,包括音频理解、视频理解、音视频联合理解等方向;参与全模态全双工大模型的研发,包括主动提醒、边看边说、打断处理等全双工特色能力
负责 MiniCPM-o 在长视频、长音视频上下文、长文本场景下的模型训练与效果优化;建设长上下文训练数据链路,处理长视频训练数据并确保稳定训练;参与长上下文全模态模型训练策略设计,包括数据配比和长序列稳定训练优化
负责 MiniCPM-o 在长视频、长音视频上下文、长文本场景下的模型训练与效果优化;建设长上下文训练数据链路,处理长视频训练数据并确保稳定训练;参与长上下文全模态模型训练策略设计,包括数据配比和长序列稳定训练优化
负责 MiniCPM-o 在长视频、长音视频上下文、长文本场景下的模型训练与效果优化;建设长上下文训练数据链路,处理长视频训练数据并确保稳定训练;参与长上下文全模态模型训练策略设计,包括数据配比和长序列稳定训练优化
负责MiniCPM-o全模态全双工模型的评测系统建设,覆盖ASR、VoiceBench、OmniBenchmark、FullDuplex Bench、LiveSports等任务;建设自动化评测流水线和评测框架的设计、维护与重构,维护评测可用性、结果可视化工具和badcase分析工具
负责MiniCPM-o全模态全双工模型的评测系统建设,覆盖ASR、VoiceBench、OmniBenchmark、FullDuplex Bench、LiveSports等任务;建设自动化评测流水线和评测框架的设计、维护与重构,维护评测可用性、结果可视化工具和badcase分析工具
负责 MiniCPM-o 在长视频、长音视频上下文、长文本场景下的模型训练与效果优化;建设长上下文训练数据链路,处理长视频训练数据并确保稳定训练;参与长上下文全模态模型训练策略设计,包括数据配比与长序列稳定训练优化
负责MiniCPM-o全模态全双工模型的评测系统建设,覆盖ASR、VoiceBench、OmniBenchmark、FullDuplex Bench、LiveSports等任务;建设自动化评测流水线和评测框架的设计、维护与重构,维护评测可用性、结果可视化工具和badcase分析工具
负责MiniCPM-o全模态全双工模型的评测系统建设,覆盖ASR、VoiceBench、OmniBenchmark、FullDuplex Bench、LiveSports等任务;建设自动化评测流水线和评测框架的设计、维护与重构,维护评测可用性、结果可视化工具和badcase分析工具
负责瑞芯微平台(RK3566/RK3576/RK3588)的NPU模型部署与优化;完成端侧大模型的全流程部署,包括模型量化、格式转换(ONNX等)及NPU推理加速;使用C/C++或Python进行嵌入式应用开发,处理多线程与网络编程任务
负责央国企、事业单位及大型集团客户的拓展、维护和商机推进;挖掘客户在行业大模型、智能体、知识库、私有化部署、AI应用落地等方向的需求;推动客户完成需求调研、方案沟通、预算立项、采购招标、合同签署及回款
面向政府及医疗、教育等行业客户,提供人工智能解决方案及商业化落地支持,承担企业级技术咨询工作;与销售团队紧密配合,全程推动产品及解决方案的拓展与销售进程,包括方案交流、需求分析、技术选型、方案设计及项目交付,助力客户成功
深入理解国内外主流SoC产品路线、NPU能力及工具链生态,结合公司产品规划,评估不同芯片平台的技术能力与合作价值;基于芯片能力、客户需求及业务方向,制定芯片生态合作策略,持续完善公司的芯片生态布局
负责多模态大模型在机器人场景中的研发与应用,涵盖SFT、RL、Agent、RAG等方向,探索前沿训练与优化方法;基于具体业务场景,设计视觉感知与大模型决策的微调方案及端到端算法解决方案,推动模型在真实机器人平台落地
负责公司内控体系建设及完善,建立风险评估机制;主导编制内控手册、权限表及相关审计制度,配合相关方完成内控诊断;制定并执行年度/季度审计计划,开展研发、供应链、数据合规、高管离任等专项审计
负责政府、央国企、大型国企、医疗、教育等大客户经营与全生命周期管理,建立高层、中层、执行层立体客户关系;负责行业线索孵化、需求挖掘、项目立项、商务谈判、合同签约、项目推进、回款全流程闭环,作为项目第一责任人
负责数字政府、政务数字员工、政企Agent、智慧医疗、智慧教育等AI项目的售前支撑、需求拆解、方案输出与价值包装;负责客户技术交流、汇报宣讲、需求调研、可行性方案、建设方案及PPT输出
负责政企AI项目(数字员工、智能Agent、政务AI、医教AI等)现场实施、部署、配置、上线、试运行、验收全流程;售前提前介入项目,评估交付边界、定制成本、落地风险,避免超范围承诺;负责客户培训、使用指导、问题排查、日常运维对接
维护数据与评测:负责真机数据处理、质量验证、评测体系建设;收集、清洗和管理机器人预训练/微调数据;商用/开源机械臂系统集成与真机评测;支持Teleop数据采集与质量验证;搭建本地真机评测流程,并集成RoboChallenge、RoboArena等开源真机评测体系
负责自研模型路由/网关平台的日常运营,包括模型接入、供应商/内部模型资源协同、调用额度、限流策略、异常处理、服务质量跟踪和用户反馈闭环;面向数据、训练、推理、算力等内部平台,建立资源申请、配额管理、容量评估、SLA/SLO、告警响应、问题复盘等运营机制,提升平台稳定性和使用体验
设计并实现自动化研发流水线,通过Agent架构将实验构思、代码编写、集群训练、自动评估和策略反馈全流程串联,打造AI驱动的研发平台;开发能够自动从最新学术论文中提取灵感、提出实验假设,并将其转化为工程任务进行验证的AutoResearch Agent智能体系统
基于技术趋势与用户研究,定义AI硬件产品的核心功能与体验;撰写产品需求,规划产品路线图,精准定义硬件规格与性能指标;驱动算法、硬件、结构团队紧密协作,解决端侧部署与量产挑战;拉通研发至市场全流程,确保产品高质量、按时上市与成功迭代
构建和维护可扩展的Agent沙盒环境,覆盖代码执行、命令行、浏览器/GUI、隔离workspace等形态,支撑评估、测试及后续业务扩展;建设Agent沙盒统一托管与调度平台,提供创建、调度、回收与基础监管能力
在客户现场进行产品的安装、集成、调试与适配,解决系统兼容性问题;使用真实客户数据,把模型或系统在生产环境中真正跑通,并对最终交付结果负责;将客户模糊的、非技术的业务痛点,翻译为具体的技术需求与可执行的解决方案
负责端侧大模型在办公、医疗、遥感、思维博弈、电磁信号、脑机接口等垂直领域落地项目的售前支撑、需求拆解、方案输出、价值包装;负责客户技术交流、汇报宣讲、需求调研、可行性方案、POC、建设方案、PPT输出
负责大模型在垂直领域的应用及研发,涵盖办公、医疗、遥感、思维博弈、电磁信号等领域方向;基于应用场景设计实现数据合成、模型微调和模型评估等解决方案;基于Agent/Multi-Agent、RAG等技术构建代码框架,推动模型落地应用
在客户现场进行产品的安装、集成、调试与适配,解决系统兼容性问题;使用真实客户数据,将模型或系统在生产环境中真正跑通,并对最终交付结果负责;将客户模糊的、非技术的业务痛点,翻译为具体的技术需求与可执行的解决方案
负责招聘信息发布、简历筛选、面试邀约等工作;负责目标院校核心人才信息mapping和信息整理;协助业务部门做好新入职员工试用期管理和融入团队;文化活动策划和落地执行;本科及以上学历,专业不限
配合算法/策略团队,参与大模型相关数据工作,并执行数据处理等任务;根据执行反馈,参与评测方法的优化工作;根据指定标准完成各类产品效果评测工作和优化方向分析;大学本科及以上学历(实习生实习周期不少于3个月,每周实习时间不少于4天)
构建并维护公司核心主流媒体资源网络,重点覆盖党央媒体、财经等重点领域,建立长期稳定的高层对话与深度合作机制;参与公司资本市场沟通体系建设,将公司技术优势与产业价值转化为资本市场可理解的叙事语言
端到端统筹政企AI类项目(数字员工、智能Agent、政务AI、医教AI等)全流程交付管理,覆盖现场实施、环境部署、系统配置、功能调优、上线试运行、问题闭环、项目验收全环节,对交付质量、进度、成本、风险全权负责
负责政府、央国企、大型国企、医疗、教育等大客户经营与全生命周期管理,建立高层、中层、执行层立体客户关系;负责行业线索孵化、需求挖掘、项目立项、商务谈判、合同签约、项目推进、回款全流程闭环,作为项目第一责任人
负责智能体产品与解决方案的设计与需求定义,输出PRD与产品规划;深入企业级重点客户,开展客户访谈与需求洞察,抽象不同客户的共性诉求,沉淀可复制的解决方案与交付方法论;将客户业务流程拆解为可被智能体承接的场景/任务,定义智能体的技能、能力边界与人设
负责企业级智能体平台的整体技术架构设计与演进;主导智能体核心能力与配套平台的架构设计,持续提升平台的通用性与可扩展性;负责平台在低延迟交互与高并发服务等不同场景下的性能与稳定性架构设计
负责办公协同、遥感解译、思维博弈推演、情报分析等政企垂直领域的大模型应用设计与开发,将通用大模型能力转化为满足行业特定需求的可交付产品;根据应用场景设计并实施数据增强与合成策略,构建高质量训练数据集,负责领域大模型的微调(SFT/RLHF)、持续训练与效果评估,优化模型在垂直任务上的表现
面向办公协同、具身智能、情报分析等防务及政务垂直领域,负责基于端侧大模型的技术方案全流程设计,包括客户需求对接、技术可行性论证、模型选型与数据策略制定,确保方案符合国产化要求、安全保密规范及防务应用场景的严苛标准,输出高质量的项目建议书和技术方案
从零到一构建覆盖文本、多模态(图/文/视频)、语音大模型的全生命周期评测体系,制定科学、客观、可量化的评测标准与指标;主导自动化评测平台与工具链的架构设计,实现大模型在预训练、SFT、RLHF等各阶段的自动化、常态化评测,支撑十亿/百亿/千亿级模型的快速迭代
负责大模型及智能体产品在政企等行业客户的项目交付,完成需求分析、方案适配、功能开发、部署上线及效果优化;基于Agent框架完成智能体应用开发,包括RAG、Prompt Engineering、Tool Calling、Workflow编排、多轮对话等能力建设,满足不同业务场景需求
负责数字政府、政务数字员工、政企Agent、智慧医疗、智慧教育等AI项目的售前支撑、需求拆解、方案输出和价值包装;负责客户技术交流、汇报宣讲、需求调研、可行性方案、建设方案及PPT输出
协助推进战略合作及投融资相关项目,负责基础资料收集、文件整理、流程跟进及项目协调;与法务、财务等部门保持密切沟通,协助完成协议、函件等材料准备及流转,并维护相关台账;根据项目需求,协助开展行业信息搜集、企业资料整理及基础研究
负责机器人操作策略从数据到部署的全链路:数据处理、模型训练、真机验证与迭代闭环,对策略在真机上的成功率与稳定性负责;参与或指导具身大模型的预训练、后训练、微调(SFT)、评测及模型部署工作,推动VLA模型在真实机器人系统上的集成与验证
负责具身数据团队的搭建与管理,制定数据采集、清洗、标注、质量评估的标准化流程与规范;基于模型训练需求规划并落地采集方案,重点攻克数据多样性、真实性、规模化三大难题(多本体、多场景、多技能、长尾任务)
负责世界模型训练数据体系建设,规划并落地视频/多模态数据体系,包括数据来源、数据结构、清洗标准、标注规范、质量评估和版本管理;主导训练数据 sourcing,建立高质量视频数据获取策略,覆盖公开视频、版权数据、合作数据、合成数据、具身采集数据等来源,评估不同来源数据对模型训练的价值、成本和风险
负责具身数据采集设备的整体设计与落地,包括遥操作/主从系统、数据手套、力反馈、多相机/深度/触觉传感方案、动捕与本体等,从需求定义、方案选型到工程实现全流程负责;主导采集设备从原型到量产的全过程,包括结构设计、选型打样、装配调试、成本控制与批量制造,保证多台设备之间的一致性与可复制性
负责多模态大模型能力的 Demo 规划与落地,包括需求定义、交互设计、开发推进和持续迭代;对接算法、工程、设计团队,推动 Demo 从概念到可用版本的快速交付;根据不同展示场景(技术发布、投资人路演、客户演示、行业展会)设计差异化展示方案
负责AI行业方向的对外传播,主导行业叙事、技术PR、产品与解决方案的对外表达;独立完成行业稿件的撰写与编辑,将复杂的AI技术/产品转化为有传播力的内容;策划并落地行业公关活动、论坛、峰会、榜单/奖项参与,统筹项目全流程与内外部资源
主导面壁智能整体品牌叙事与品牌架构设计,沉淀公司级品牌方法论与话语体系;支持公司领导人对外发言:为演讲、访谈、重大场合提供叙事框架、核心观点与内容打磨;将品牌策略拆解落地,支撑融资、商业化、技术PR、雇主品牌等各业务线的对外表达与素材体系
建设与维护公司核心媒体关系网络,覆盖科技、财经、行业垂直等重点媒体;主导媒介采购与投放:管理媒体资源采买流程、供应商筛选与谈判、预算规划与效果评估;统筹重大传播节点的媒体排期、发稿协调与稿件把控
负责面壁品牌视觉体系建设与落地:品牌VI、传播物料、活动/会议视觉、新媒体视觉等;不仅做设计,更做设计管理:统筹内外部设计资源,把控视觉品质与品牌一致性;善用AI工具进行创意与内容生成,探索并沉淀AIGC在品牌视觉中的高效工作流
建设并丰富财经媒体关系网络,覆盖一级/二级市场财经媒体、券商研究、行业分析师等;支持公司融资、资本市场沟通与投资者关系相关的对外传播;主导财经议题的叙事策划与稿件产出,塑造公司在资本市场的品牌形象
构建Agent原生的统一工作系统,整合研发核心场景为单一工作流;重新设计人与Agent的分工边界,使人从操作工具转向给出目标与偏好、验收结果;构建支撑一体化的基础设施,实现状态与上下文在不同场景间的流转
负责端侧大模型在办公、具身智能、医疗、遥感、思维博弈、电磁信号等垂直领域的解决方案设计;具备大模型预训练、微调等基础知识,能够针对客户需求完成模型选型、数据策略制定及微调方案设计;熟练运用Vibe Coding范式,借助自然语言驱动的高效编码方式,快速生成、迭代和调试代码原型
参与对话式AI产品的全流程研发,探索大模型在办公、教育、金融等垂直领域的创新应用,并推动技术落地;构建和优化端到端智能体系统,覆盖Agent loop搭建、Harness调优、Skill演化、Memory构建等方面,持续提升交互体验
面向GPU/昇腾架构开展算子性能画像、热点定位与优化,持续提升吞吐与时延稳定性;结合训练与推理场景,协同框架与编译链路进行内核调优、算子融合、内存访问与并行策略优化;建设性能基线与度量方法,沉淀可复用的优化范式与最佳实践,推动持续优化闭环
负责项目从启动到交付的全过程管理,跟进整体进度、阶段节点和任务落地;拆解项目任务,明确责任人和时间节点,推动各方按计划执行;协调业务、技术及相关协作团队,保障信息同步顺畅、问题响应及时
负责企业级Agentic Infra私有化部署架构设计,覆盖Kubernetes、GPU/NPU资源、模型Serving、对象存储、消息队列、日志监控、权限与网络安全等关键组件;面向运营商、金融民生等客户复杂IT环境,完成部署方案、资源评估、容量规划、网络拓扑、数据安全、容灾与运维方案设计
负责端云协同AI架构设计,明确云侧模型、私有化服务、边缘节点、端侧设备之间的职责边界、数据流、控制流和安全边界;围绕面壁miniCPM等系列产品,面向运营商营业厅、客服坐席、现场运维、企业办公终端、边缘网关等场景,建设端云协同的数字员工能力
深入客户现场,与业务用户一起梳理原工作流,识别高频、重复、知识密集、跨系统协同的任务,并判断是否适合数字员工或 Agentic Workflow 改造;基于客户场景快速开发 0->1 原型,包括 RAG、Prompt、Tool Calling、Workflow 编排、多轮对话、表单/审批/工单/知…
深入客户现场,梳理客户原有业务流程、组织分工、系统边界、数据流和审批链路,识别适合数字员工、智能体、Agentic Workflow、知识助手、智能运营等方向的AI化改造机会;面向运营商客服、政企运营、渠道管理、运维支撑、营销增长、企业知识管理、合规审核等场景,设计可落地的大模型/Agent解决方案
负责科研经费预算、核算工作,包括科研经费核算、数据统计、项目收支分析、预算执行情况跟踪等;深度参与科研项目,开展事前、事中、事后跟踪管理,从资金、预算、业务等方面跟踪监控,为科研提供及时有效的财务支持
深入客户现场,与业务用户一起梳理原工作流,识别高频、重复、知识密集、跨系统协同的任务,并判断是否适合数字员工或 Agentic Workflow 改造;基于客户场景快速开发 0->1 原型,包括 RAG、Prompt、Tool Calling、Workflow 编排、多轮对话、表单/审批/工单/知…
负责公司AI产品及智能体平台的整体质量体系建设,制定测试规范、质量标准和研发质量流程,持续提升产品稳定性和交付效率;负责测试团队建设与管理,推动自动化测试平台、测试工具和质量平台建设,提升测试效率和研发效能
负责端云协同AI架构设计,明确云侧模型、私有化服务、边缘节点、端侧设备之间的职责边界、数据流、控制流和安全边界;围绕面壁miniCPM等系列产品,面向运营商营业厅、客服坐席、现场运维、企业办公终端、边缘网关等场景,建设端云协同的数字员工能力
负责企业级Agentic Infra私有化部署架构设计,覆盖Kubernetes、GPU/NPU资源、模型Serving、对象存储、消息队列、日志监控、权限与网络安全等关键组件;面向运营商、金融民生等客户复杂IT环境,完成部署方案、资源评估、容量规划、网络拓扑、数据安全、容灾与运维方案设计
负责AI行业方向的对外传播,主导行业叙事、技术PR、产品与解决方案的对外表达;独立完成行业稿件的撰写与编辑,将复杂的AI技术/产品转化为有传播力的内容;策划并落地行业公关活动、论坛、峰会、榜单/奖项参与,统筹项目全流程与内外部资源
负责法律智能业务产品的整体规划与建设,制定产品方向、功能策略及阶段性目标,推动产品持续迭代优化;深入理解法律行业及客户业务场景,洞察用户需求,形成产品解决方案并推动落地;协同技术、算法、运营、销售等团队,推进法律智能产品从需求分析、方案设计到研发交付的全流程管理
协助采购项目前期筹备、资料整理及供应商对接,梳理需求与预算,跟进招标/询价等环节,保障项目规范推进;建立采购进度台账,跟踪询价、合同、订单、验收等全周期节点,识别滞后风险并反馈,推动问题解决
协助财务团队进行日常财务工作,包括装订并整理会计凭证、财务入账处理、对接科研审计及尽调审计等;参与财务数据的收集、整理和分析,提供财务建议;协助团队进行预算管理和财务规划;保持与团队成员的良好沟通,确保工作的顺利进行
设计并演进 Agent Harness,包括运行时编排、工具调用、上下文与执行环境,支撑编码、搜索等 Agent 的后训练与应用落地;设计 Agent-to-Agent(A2A)协作与任务分解方案,满足生产环境的可靠性、安全与可观测性
负责大模型前沿技术成果与技术人才成长的内容产出,包括但不限于文章、图片、视频等形式;提炼并发布具有传播度与品牌可塑性的AI技术/人才话题;通过开拓并维护内外部技术人才与品牌渠道,扩大公司在技术人才招聘上的知名度与影响力
构建和维护可扩展的 Agent 沙盒环境,覆盖代码执行、命令行、浏览器/GUI、隔离 workspace 等形态,支撑评估、测试及后续业务扩展;建设 Agent 沙盒统一托管与调度平台,提供创建、调度、回收与基础监管能力
负责与客户沟通,促成业务合作,为签单结果负责,跟踪项目整体情况,包括招标时间、负责人等,并制定相应计划;与售前团队共同筛选和优化商机,确保资源合理分配,重点支持对产品PMF有帮助的项目,及时传递客户需求并协调内部资源
负责招聘信息发布、简历筛选、面试邀约等工作;负责目标院校核心人才信息Mapping和信息整理;协助业务部门做好新入职员工试用期管理和融入团队;文化活动策划和落地执行;本科及以上学历,专业不限
根据岗位需求,在招聘渠道发布岗位、负责简历的初筛、分类和推荐,与候选人进行初步沟通以及面试安排等;员工入职办理、人事证明开具、人员信息管理等;员工日常人事咨询处理,包括考勤、社保及各类流程问题解答
大模型数据整理和研究;协助构建大模型数据评测体系;大模型竞品跟踪调研;协助梳理大模型场景需求;协助大模型项目及产品需求场景落地实现;大三及以上年级,法律专业基础知识扎实,有法院、律所实习经验优先
结合AI行业热点与公司产品动态,策划符合平台调性的选题与传播素材;参与短视频脚本撰写、拍摄协助及后期剪辑;协助线上/线下活动的策划与执行,如发布会、沙龙、直播等,负责物料准备、流程跟进与现场支持
负责招聘信息发布、简历筛选、面试邀约等工作;负责目标院校核心人才信息Mapping和信息整理;协助业务部门做好新入职员工试用期管理和融入团队;文化活动策划和落地执行;本科及以上学历,专业不限
参与智能座舱AI产品方案设计与需求梳理;协助完成PRD、流程图、体验方案等文档输出;参与Agent、记忆、主动服务等场景设计;调研国内外智能汽车、AI Agent、端侧模型行业趋势;协助推进Demo、展会、客户交流等项目支持
参与大模型算法的研发与优化;负责强化学习、工具学习相关算法的设计与实现;进行端到端优化,提升智能体在竞赛编程中的表现;跟踪最新技术动态,推动算法创新;本科及以上学历,计算机、人工智能等相关专业
参与具身智能系统软件(Agent/Harness)框架的设计与开发,熟悉并应用ROS/ROS2进行机器人系统通信与数据流管理;负责多源异构数据的采集、清洗、对齐与标注(如视觉-语言-动作VLA数据、第一视角视频、IMU、触觉/力觉数据)
负责AI产品在小红书、微信公众号等新媒体矩阵的日常运营,包括选题策划、文案撰写、排版编辑及发布,确保内容在不同平台的高质量输出;深度结合AI工具赋能内容创作全流程,利用AI进行高效选题挖掘、爆款标题生成、文案润色优化以及基础配图制作
构建AI研发闭环系统,设计并实现自动化研发流水线,通过Agent架构将实验构思、代码编写、集群训练、自动评估和策略反馈全流程串联,打造AI驱动的研发平台;开发AutoResearch Agent,能够自动从最新学术论文中提取灵感、提出实验假设,并将其转化为工程任务进行验证
负责企业创意营销活动和视频号策划、内容创作、发布复盘及日常运营;协助信息流投流工作,包括素材整理、投放数据统计、报表汇总和效果优化;参与线下展会、营销活动的前期筹备、现场执行和后期复盘,跟进全流程落地
参与公司层面品牌传播和公关项目的创意构思和设计执行;根据项目需求,进行平面设计、网页设计、社交媒体宣传图等相关设计工作;对品牌形象和视觉传达进行维护和优化,确保一致性和专业性;协助团队完成其他相关设计支持和辅助工作
负责灵巧手、机械臂、人体全身数据采集自研设备的结构设计;搭建遥操作与数据采集平台;负责建立人体、全向轮底盘、机械臂末端、相机及任务空间之间的统一坐标系;设计安装基准、标定流程、数据采集人机交互方案
负责团队内部知识库的搭建维护,对各类业务方案、标准SOP和技术规范进行标准化归档;协助各小组梳理、提炼项目验证成功的优秀案例与标准工作流模板,建立共享资产库,提升团队复用效率;负责团队周会及各类项目同步会的组织,跟进并督办跨专业小组待办事项的落地,把控时间节点
参与端侧AI模型的评测工作,包括LLM、ASR、TTS等模型在不同设备上的效果与性能测试;协助搭建和维护端侧模型Benchmark体系,评估指标包括准确率、响应延迟、吞吐、内存占用、功耗、稳定性等
参与算力平台、数据平台、训练平台、推理平台、评测平台等内部系统的架构设计、全栈开发和持续迭代,支撑大模型研发全流程的平台化建设;建设数据采集、数据清洗、数据处理、标注生产、质量评估、数据资产管理等能力,提升数据生产链路的自动化、标准化和可追溯性
负责端侧大模型在办公、具身智能、医疗、遥感、思维博弈、电磁信号等垂直领域的解决方案设计;具备大模型预训练、微调等基础知识,针对客户需求完成模型选型、数据策略制定及微调方案设计;熟练运用Vibe Coding范式,借助自然语言驱动的高效编码方式,快速生成、迭代和调试代码原型
持续跟踪国内外大模型行业动态,覆盖基础模型、评测体系、竞争格局等重点方向;对主流模型厂商、研究机构、开源社区及关键产品开展系统研究,形成结构化分析和阶段性判断;建立并维护基础模型研究资料库,支持公司战略决策
负责Agent平台的日常运营工作,制定阶段性运营计划并推进落地;围绕平台核心目标,提升用户注册、激活、留存、Agent创建和使用等关键指标;负责平台内容运营,包括Agent模板、使用教程、场景案例、最佳实践等内容建设
负责自研模型路由/网关平台的日常运营,包括模型接入、供应商/内部模型资源协同、调用额度、限流策略、异常处理、服务质量跟踪和用户反馈闭环;面向数据、训练、推理、算力等内部平台,建立资源申请、配额管理、容量评估、SLA/SLO、告警响应、问题复盘等运营机制,提升平台稳定性和使用体验
在客户现场进行产品的安装、集成、调试与适配,解决系统兼容性问题;使用真实客户数据,将模型或系统在生产环境中真正跑通,并对最终交付结果负责;将客户模糊的、非技术的业务痛点,翻译为具体的技术需求与可执行的解决方案
围绕硬件产品,协助制定内容策划方案,向海外用户清晰、有吸引力地讲述产品故事;深入理解AI硬科技产品的核心价值,输出符合不同市场用户认知习惯的内容;结合海内外市场的内容消费习惯,制定差异化的内容表达策略
梳理法律Agent/skill测试用例数据标注痛点,主导评测标注系统设计,搭建高效稳定的数据飞轮;构建面向法律行业的主流Agent架构评测指标体系,设计系统化测评方案与量化评分规则;融合人工标注数据与自动化机评结果,持续驱动Agent/skill架构迭代优化
负责多模态大模型在机器人场景中的研发与应用,涵盖SFT、RL、Agent、RAG等方向,探索前沿训练与优化方法;基于具体业务场景,设计视觉感知与大模型决策的微调方案及端到端算法解决方案,推动模型在真实机器人平台落地
负责官方公众号(订阅号、视频号、抖音等)的日常排版、配图设计及视觉优化,确保内容简洁专业且符合品牌规范;结合公司业务节奏和行业热点,制定月度/周度内容排期,完成原创、互动、转发等策划,并基于数据反馈持续优化内容方向
负责大模型在垂直领域的应用及研发,涵盖办公、医疗、遥感、思维博弈、电磁信号等领域方向;基于应用场景设计实现数据合成、模型微调和模型评估等解决方案;基于Agent/Multi-Agent、RAG等技术构建代码框架,推动模型落地应用
梳理法律Agent/Skill测试用例数据标注痛点,主导评测标注系统设计,搭建高效稳定的数据飞轮;构建面向法律行业的主流Agent架构评测指标体系,设计系统化测评方案与量化评分规则;融合人工标注数据与自动化机评结果,持续驱动Agent/Skill架构迭代优化
在客户现场进行产品的安装、集成、调试与适配,解决系统兼容性问题;使用真实客户数据,确保模型或系统在生产环境中顺利运行,并对最终交付结果负责;将客户模糊的、非技术的业务痛点,翻译为具体的技术需求与可执行的解决方案
负责大模型在垂直领域(办公、医疗、遥感、思维博弈、电磁信号等)的应用及研发;基于应用场景设计并实现数据合成、模型微调和模型评估等解决方案;基于Agent/Multi-Agent、RAG等技术构建代码框架,推动模型落地应用
深入对齐模型训练节奏,与研究员深度对齐,将工程需求转化为数据指标;制定数据建设方向,将模型能力需求转化为明确的数据类型、规模、质量标准、分布要求和验收指标;识别关键数据缺口,输出数据需求文档,明确内容形态、样例要求、质量口径、规模预期和验收方式
负责大模型在垂直领域的应用及研发,涵盖办公、医疗、遥感、思维博弈、电磁信号等领域方向;基于应用场景设计实现数据合成、模型微调和模型评估等解决方案;基于Agent/Multi-Agent、RAG等技术构建代码框架,推动模型落地应用
负责车企客户及Tier1客户的技术交流与需求分析;负责智能座舱AI、车载Agent、多模态交互等场景的整体解决方案设计;输出系统架构图、部署架构图、资源评估方案及POC方案;针对客户提出的模型、芯片、资源占用及系统集成问题进行技术解答
负责大模型前沿技术成果与技术人才成长的内容产出,包括但不限于文章、图片、视频等形式;提炼并发布具有传播度与品牌可塑性的AI技术/人才话题;通过开拓并维护内外部技术人才与品牌渠道,扩大面壁智能在技术人才招聘上的知名度与影响力
负责与客户沟通,促成业务合作,为签单结果负责;跟踪项目整体情况,包括招标时间、负责人等,制定相应计划;与售前团队共同筛选和优化商机,确保资源合理分配和利用;支持产品进行PMF有帮助的项目,及时传递客户需求并协调内部资源
负责智能座舱(中控屏、仪表盘、HUD、副驾屏、后排娱乐屏等)的交互架构、用户旅程和场景流设计;探索并定义多模态交互(语音、手势、视线追踪、物理按键)在车载场景下的融合应用,特别关注AI智能体与用户的自然交互与主动服务协同
负责构建并维护公司核心主流媒体资源网络,重点覆盖党央媒体、财经等重点领域,建立长期稳定的高层对话与深度合作机制;参与公司资本市场沟通体系建设,将公司技术优势与产业价值转化为资本市场可理解的叙事语言
负责法律智能业务产品的整体规划与建设,制定产品方向、功能策略及阶段性目标,推动产品持续迭代优化;深入理解法律行业及客户业务场景,洞察用户需求,形成产品解决方案并推动落地;协同技术、算法、运营、销售等团队,推进法律智能产品从需求分析、方案设计到研发交付的全流程管理
负责垂直行业AI智能体应用的定制开发与工程落地,基于自研大模型基座,完成场景化Agent流程编排、工具集成、业务逻辑定制开发;在客户现场进行智能体系统产品的部署、集成、调试、适配、上线、试运行、验收全流程,协助客户解决系统兼容性问题
维护数据与评测,负责真机数据处理、质量验证、评测体系建设;收集、清洗和管理机器人预训练/微调数据;商用/开源机械臂系统集成与真机评测,支持Teleop数据采集与质量验证;搭建本地真机评测流程,并集成RoboChallenge、RoboArena等开源真机评测体系
结合公司已有的标杆客户案例,面向客户提供大模型售前解决方案,协助业务团队实现业绩增长;配合销售团队进行大模型售前交流、POC、解决方案编写、招投标技术方案等工作;挖掘、洞察行业共性需求,调研市场优质方案和产品,帮助产品团队打磨更具市场化的创新应用
负责端侧大模型在办公、具身智能、医疗、遥感、思维博弈、电磁信号等垂直领域的解决方案设计;具备大模型预训练、微调等基础知识,针对客户需求完成模型选型、数据策略制定及微调方案设计;熟练运用Vibe Coding范式,借助自然语言驱动的高效编码方式,快速生成、迭代和调试代码原型
负责端侧大模型在办公、医疗、遥感、思维博弈、电磁信号、脑机接口等垂直领域落地项目的售前支撑、需求拆解、方案输出、价值包装;负责客户技术交流、汇报宣讲、需求调研、可行性方案、POC、建设方案、PPT输出
面向政府及医疗、教育等行业客户,提供人工智能解决方案及商业化落地支持,承担企业级技术咨询工作;与销售团队紧密配合,全程推动产品及解决方案的拓展与销售进程,包括方案交流、需求分析、技术选型、方案设计及项目交付,助力客户成功
结合公司已有的标杆客户案例,面向客户提供大模型售前解决方案,协助业务团队实现业绩增长;配合销售团队进行大模型售前交流、POC、解决方案编写、招投标技术方案等工作;挖掘、洞察行业共性需求,调研市场优质方案和产品,帮助产品团队打磨更具市场化的创新应用
负责开拓和维系与各级人大、政府法制办、司法行政部门、政策研究室等立法机构,以及法律信息数据库、知识管理平台、智库等知识服务类企业的合作关系;精准识别关键决策人,建立并维护高价值的客户关系网络,深度挖掘客户需求
负责为大模型训练所需的英文数据进行标注、质检与评测,包括但不限于指令理解、对话质量评估、偏好排序、生成式内容打分等,确保数据高质量交付;在标注过程中识别数据或指令中的问题,结合模型表现提出对标注标准、采样策略或任务设计的优化建议,提升训练数据有效性
构建核心数据引擎:主导多模态大模型在预训练、指令微调(SFT)及偏好对齐(RLHF)等全阶段的数据体系建设;攻克多模态语料的智能采集、多维清洗、去重过滤、自动化标注与深度挖掘等核心技术壁垒
负责大模型预训练加速算法的研究与优化,涵盖MoE、多模态、创新架构等核心方向;针对MoE架构进行专项优化,解决Expert并行、负载均衡、通信优化等关键技术问题;研究并优化多模态模型(Vision-Language、Audio-Language等)的训练效率
负责大模型预训练加速算法的研究与优化,涵盖MoE、多模态、创新架构等前沿方向;针对MoE架构进行专项优化,包括Expert并行、负载均衡、通信优化等核心问题;研究并优化多模态模型(Vision-Language、Audio-Language等)的训练效率
负责大模型预训练加速算法的研究与优化,覆盖MoE、多模态、创新架构等方向;针对MoE架构进行专项优化,包括Expert并行、负载均衡、通信优化等核心问题;研究并优化多模态模型(如Vision-Language、Audio-Language等)的训练效率
基于现有强化学习算法框架,建设并部署支撑RL训练高效稳定运行的基础设施;优化强化学习训练流程与框架,持续提升训练效率和模型性能;与团队协作,推动Infra方案落地,保障强化学习模型的高效训练
基于瑞芯微平台(RK3566/RK3576/RK3588)进行嵌入式Linux系统开发与NPU模型部署;负责端侧大模型部署全流程,包括模型量化、格式转换(ONNX等)及NPU推理加速
基于现有强化学习算法框架,建设并部署支撑RL训练的高效稳定基础设施;优化强化学习训练流程与框架,持续提升训练效率和模型性能;与团队协作,推动Infra方案落地,保障强化学习模型的高效训练
基于现有强化学习算法框架,建设并部署支撑RL训练的高效稳定基础设施;优化强化学习训练流程与框架,持续提升训练效率和模型性能;与团队协作,推动Infra方案落地,保障强化学习模型的高效训练
基于现有强化学习算法框架,建设并部署支撑RL训练高效稳定运行的基础设施;优化强化学习训练流程与框架,持续提升训练效率和模型性能;与团队协作推动Infra方案落地,保障强化学习模型的高效训练
协助公司智能硬件产品的海外KOL/Creator开发与合作推进,重点面向欧美市场,平台包括Instagram、TikTok、YouTube等;根据产品定位,筛选匹配的lifestyle、科技、潮玩、礼物、家居等方向创作者
参与MiniCPM-o多模态模型的音视频联合理解能力建设,包括音频理解、视频理解、音视频联合理解等方向;参与全模态全双工大模型的研发,实现主动提醒、边看边说、打断处理等全双工特色功能
阅读、理解并参与主流开源项目(如 llama.cpp、Ollama、vllm 等)源码分析与功能扩展;编写高性能代码,优化模型运行效率与内存占用;对多模态大语言模型有基本了解,有使用经验或参与过相关项目
负责MiniCPM-o在长视频、长音频视频上下文、长文本场景下的模型训练与效果优化;建设长上下文训练数据链路,完成长视频训练数据处理与稳定训练;参与长上下文全模态模型训练策略设计,包括数据配比与长序列稳定训练优化
熟悉并跑通现有端到端管线,收集并构建包含非专业视角的视频数据集(如冗余镜头较多的二创视频、Vlog);利用VLM工具进行批量标注,定位低质量或冗余镜头;设计预告片多版本对照实验,通过对比官方不同剪辑版本提取决策标签
参与多模态大模型强化学习相关的数据建设,包括图、文推理数据、视频数据、指令数据等类型的构建和scaling;确保数据提升闭环到模型基础能力提升;参与多模态推理数据的去重、检索、分析、改写等环节,提升数据质量与利用率
负责招聘信息发布、简历筛选、面试邀约等招聘相关工作;负责目标院校核心人才信息的mapping与信息整理;协助业务部门做好新入职员工试用期管理和融入团队支持;负责企业文化活动的策划与落地执行
构建多模态大模型在Pre-training、SFT及RLHF全阶段的核心数据引擎,主导海量多模态语料的智能采集、多维清洗、去重过滤与自动化标注;建立“数据合成与构造 -> 模型训练 -> 能力评测”的全链路闭环验证体系,通过数据消融与归因分析推动模型基础能力上限突破
负责SGLang与vLLM双引擎及AWQ INT4量化栈的部署、监控与调优,推动单节点吞吐与P99首token延迟持续达标;主导网关层JWT身份层、多租户路由、隐私分级模块的设计、实现与故障演练
负责公司法律业务系统的后端研发与设计工作;参与现有技术架构的重构与优化维护;负责核心模块开发与代码评审,把控项目质量,保障系统平台的高可用、高性能;负责解决项目中的技术难题,进行关键技术难点攻关
围绕硬件产品协助制定内容策划方案,向海外用户清晰、有吸引力地讲述产品故事;深入理解AI硬科技产品的核心价值,输出符合不同市场用户认知习惯的内容;结合海内外市场的内容消费习惯,制定差异化的内容表达策略
负责端侧大模型在办公、具身智能、医疗、遥感、思维博弈、电磁信号等垂直领域的解决方案设计与技术落地,具备大模型预训练、微调等基础知识,完成模型选型、数据策略制定及微调方案设计;熟练运用Vibe Coding范式,借助自然语言驱动的高效编码方式,快速生成、迭代和调试代码原型,缩短从需求到可运行方案的验…
负责官方公众号(订阅号、视频号、抖音等)的日常排版、配图设计及视觉优化,确保排版简洁专业、符合品牌视觉规范;结合公司业务节奏和行业热点,制定月度/周度内容排期,完成账号原创、互动、转发等策划,基于数据反馈持续优化内容方向
负责内外部舆情洞察,将内部叙事转化为受众听得懂的价值语言,撰写公司战略发声、财经新闻、产品发布、行业白皮书等核心稿件;围绕产品发布、行业活动、生态合作等关键节点,策划并落地完整的传播方案,包括选题策划、媒体传播、稿件排期与效果复盘
负责实验室共建单位拓展、学术/技术委员会组建与运营,组织闭门研讨会;主导行业白皮书、趋势报告的选题策划、内容撰写与发布;策划执行常态化技术沙龙、产学研对接活动;对接政府及行业机构,参与标准制定与课题申报
负责MiniCPM-o全模态全双工模型的评测系统建设,覆盖ASR、VoiceBench、OmniBenchmark、FullDuplex Bench、LiveSports等任务;建设自动化评测流水线和评测框架的设计、维护与重构
负责央国企、事业单位及大型集团客户的拓展、维护和商机推进;挖掘客户在行业大模型、智能体、知识库、私有化部署、AI应用落地等方向的需求;推动客户完成需求调研、方案沟通、预算立项、采购招标、合同签署及回款
负责大规模分布式训练和推理的基础架构设计、开发与优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,解决多模态场景下的训练效率瓶颈
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,对领域最新技术进行及时吸纳和改进,通过技术创新和工程实践支撑模型能力提升
负责大规模分布式训练和推理的基础架构设计、开发与优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈
基于大语言模型开展数据探索、挖掘、合成与调优,深度参与数据处理、模型训练及评测等核心流程;根据算法理解,主动提出创新性方法并进行快速原型验证;支持数据处理自动化工具的开发与优化,提升团队工作效率
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练,涉猎模型高效结构、多模态 scaling law、数据配比、性能优化等方向探索;参与多模态大模型的训练加速和高效部署,包括系统调优、硬件适配等工作
负责大规模分布式训练和推理的基础架构设计、开发与优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,解决多模态场景下的训练效率瓶颈
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练,涉及模型高效结构、多模态 scaling law、数据配比、性能优化等探索;参与多模态大模型的训练加速和高效部署,包括系统调优、硬件适配等工作
主导语音大模型的前沿算法研究及产业落地工作;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,对领域最新技术进行及时吸纳和改进,通过技术创新和工程实践支撑模型能力提升
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;进行多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;开展多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;进行多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等技术方向;探索前沿训练与优化方法,持续提升模型性能与效率;基于业务场景设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责大模型预训练加速算法的研究与优化,涵盖MoE、多模态、创新架构等方向;针对MoE架构进行专项优化,包括Expert并行、负载均衡、通信优化等核心问题;研究并优化多模态模型(如Vision-Language、Audio-Language等)的训练效率
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景设计模型微调方案及算法/系统解决方案,推动模型在端侧场景的落地应用
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,涵盖数据采集、数据入库、数据清洗、数据观测与数据挖掘等全环节;负责多模态数据的闭环验证,建立从数据构造、模型训练到性能评测的全链路闭环体系,确保数据有效提升模型基础能力
负责技术成果发布的官方传播视频制作,通过动效、动画设计等手段包装技术与产品的亮点,发布在海内外不同平台上;负责开发者使用与部署教程、产品功能使用引导等视频内容的剪辑包装;具备基础平面设计能力,能够创作符合科技行业需求的视觉内容,包括海报、品牌物料、UI辅助设计等
签单与客户沟通,负责与客户沟通,促成业务合作,为签单结果负责;作为项目第一线跟踪者,了解项目整体情况,包括招标时间、负责人、领导等,并制定相应计划;与售前团队共同筛选和优化商机,确保资源的合理分配和利用,重点支持对产品PMF有帮助的项目
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、入库、清洗、观测与挖掘等环节;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系
负责语音方向(ASR/TTS)大模型的研发与应用,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用;跟踪前沿技术动态,探索AI在公共服务、民生场景中的智能化与普惠化应用
设计多源异构数据采集管线,对接遥操作、动捕、外骨骼、仿真等不同数据源,完成从原始传感器数据到可训练格式的全链路;构建数据处理与增强算法,包括视觉域适配、异常轨迹检测与清洗、多模态对齐(RGB、深度、触觉、关节角、力矩等)
主导汽车行业大模型商业化项目全流程管理,建立项目管控体系,把控进度、质量、成本,确保按时按质按预算交付;联动销售、市场、研发等多团队,制定大模型产品商业化推广策略,推动产品在主机厂、Tier1供应商等客户群体落地与复购
深入研究海外目标市场(中东、欧洲、东南亚、拉美等)的行业痛点,结合面壁智能大模型及Agent标杆案例,打造具备国际竞争力的销售解决方案,主动驱动海外业务营收增长;紧密配合海外销售团队,主导与全球客户及合作伙伴的技术交流、商务谈判及POC验证;负责海外大标项目的招投标方案撰写,精准匹配技术价值与商业…
参与VoxCPM语音大模型研发,负责语音模型能力研发和效果提升;探索语音大模型在实际场景中的应用落地,解决应用落地过程中的前沿问题;深入调研音频和大模型领域前沿技术,参与语音大模型前沿技术研发
主导汽车行业大模型商业化项目全流程管理,建立项目管控体系,把控进度、质量、成本,确保项目按时按质按预算交付,规避项目风险;联动销售、市场、研发等多团队,制定大模型产品商业化推广策略,推动产品在主机厂、Tier1供应商等客户群体落地与复购
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、数据入库、数据清洗、数据观测、数据挖掘等环节;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系,确保数据有效提升模型基础能力
结合公司模型特点及客户业务场景,制定针对性解决方案,推进大模型产品落地推广,对销售业绩负责;拓展汽车行业客户,对接合作机构需求梳理与反馈,组织相关资源完成需求处理并跟进落地;归类总结客户需求,有效传达给产品和研发团队,推进需求解决方案落地执行
参与强化学习训练基础设施建设,支持大规模RL/LLM RL训练任务的高效、稳定运行;负责训练系统关键模块开发与优化,包括任务调度、分布式训练、样本采集、经验回放、日志监控、容错恢复、资源利用率优化等
参与SWE-bench、LiveCodeBench等主流Code/Agent Benchmark模型能力训练,覆盖Repo级代码理解、长程Agent规划、自动化代码修复与跨文件工程任务
体系建设:围绕各类科研项目的流程体系、要求规范等开展系统性调研与分析,形成研究报告或知识沉淀,并持续更新;合作支持:协助推进科研项目从筹划、立项、申报、执行、结案等的全流程,包括项目资料整理与内部管理事务等
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练,涉及模型高效结构、多模态scaling law、数据配比、性能优化等探索;参与多模态大模型的训练加速和高效部署,包括系统调优、硬件适配等工作
参与强化学习训练基础设施建设,支持大规模RL/LLM RL训练任务的高效、稳定运行;负责训练系统关键模块开发与优化,包括任务调度、分布式训练、样本采集、经验回放、日志监控、容错恢复、资源利用率优化等
核心模块研发:优化智能体持续任务执行能力,在给定计算资源和时间范围内优化Agent Loop闭环工作流程,直接提升AI智能体在复杂场景下的任务完成率和资源使用效率;通用任务能力拓展:针对智能体处理通用任务的目标,负责特定方向的深入调研与实现,探索智能体在软件开发、报告编写、自动化办公等场景的专业解…
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,对领域最新技术进行及时吸纳和改进,通过技术创新和工程实践支撑模型能力提升
协助HRBP进行企业文化建设与活动运营;支持招聘全流程,包括候选人搜寻与面试邀约;参与培训调研、AI做课及OTD相关活动运营;与团队协作推进招聘工作的落地执行;具备AI或互联网等多渠道人才招聘经验
构建和优化针对端侧模型的Search Agent训练与冷启动数据,持续提升模型性能;针对端侧模型Search Agent强化学习场景,构建有效的复杂Query与训练策略;针对端侧模型研发合适的上下文管理,提升在Browsecomp等复杂长程任务上的能力
基于大语言模型开展数据探索、挖掘、合成与调优,深度参与数据处理、模型训练及评测等核心流程;根据算法理解,主动提出创新性方法并进行快速原型验证;支持数据处理自动化工具的开发与优化,提升团队工作效率
基于大语言模型开展数据探索、挖掘、合成与调优,深度参与数据处理、模型训练及评测等核心流程;根据算法理解,主动提出创新性方法并进行快速原型验证;支持数据处理自动化工具的开发与优化,提升团队工作效率
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;进行多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责多模态训练基础设施的整体架构设计与技术规划,主导Infra方案的落地实施;搭建并优化大规模训练系统,确保千/万卡级别集群的高效稳定运行;主导训练框架的选型、优化与二次开发,持续提升训练效率与资源利用率
负责大模型预训练加速算法的研究与优化,涵盖MoE、多模态、创新架构等方向;针对MoE架构进行专项优化,包括Expert并行、负载均衡、通信优化等核心问题;研究并优化多模态模型(Vision-Language、Audio-Language等)的训练效率
大模型与多模态模型的量化方案设计与实现;权重量化、激活量化及混合精度策略的工程化落地;量化过程中异常值的分析与处理,包括对精度影响的评估与策略选择;KV Cache、Attention、FFN等核心模块的量化与验证
构建和优化端到端智能系统,覆盖意图识别、多轮问答改写、知识检索、内容生成与用户偏好对齐,持续提升交互体验;参与对话式AI产品的全流程研发,探索大模型在教育等垂直领域的创新应用,并推动技术落地
持续跟踪国内外大模型行业动态,覆盖基础模型、评测体系、竞争格局等重点方向;对主流模型厂商、研究机构、开源社区及关键产品开展系统研究,形成结构化分析和阶段性判断;参与基础模型相关专题研究,包括模型能力演进、技术路线变化、多模态、Agent、端侧等重点方向,收集并分析benchmark、榜单、论文等信息
独立规划并搭建生产级K8s集群,设计高可用架构;维护容器镜像仓库(Harbor、Docker Registry)和CI/CD流水线;将传统应用迁移至容器化环境,优化资源利用率;部署和调优大模型服务,确保低延迟和高吞吐量
分布式训练引擎研发:将算法逻辑高效转化为大规模分布式系统实现,深度定制训练底座;异构算力性能优化:针对NVIDIA H系列或国产算力优化NCCL/HCCL通信策略,极致提升MFU;并行策略开发:深度调优3D并行(TP/PP/DP),引入序列并行(SP)、上下文并行(CP)等技术
设计多源异构数据采集管线,对接遥操作、动捕、外骨骼、仿真等不同数据源,完成从原始传感器数据到可训练格式的全链路;构建数据处理与增强算法,包括视觉域适配(人手→机器人手inpainting)、异常轨迹检测与清洗、多模态对齐(RGB+深度+触觉+关节角+力矩)
负责车端大模型应用架构设计与落地,聚焦舱内外视觉理解、意图识别、哨兵、记忆、Agent等场景;协调算法、工程、测试及外部合作方(主机厂/供应商),完成工程开发与项目交付;优化推理效率,降低CPU/NPU/GPU资源占用,确保系统稳定运行
负责端侧AI能力在IoT场景中的产品化落地,包括语音、多模态感知、上下文理解、设备控制等;构建端侧智能能力框架,包括意图识别、场景引擎、记忆系统、策略决策等核心模块;推动产品从被动控制向主动服务演进,实现自动化触发与预测式服务
负责天猫、京东、抖音等电商渠道的日常运营,包括商品上架、活动策划、流量分析及GMV达成;管理海内外众筹平台项目,负责项目上线、推广节奏规划、粉丝转化及数据复盘;搭建并运营微信群、企业微信、小红书等私域社群,策划用户互动活动,维护社群活跃度与用户留存
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、数据入库、数据清洗、数据观测、数据挖掘等环节;负责多模态数据的闭环验证,建立从数据构造、模型训练到性能评测的全链路闭环体系,确保数据有效提升模型基础能力
负责端侧设备上的大模型部署和集成,确保系统稳定高效运行;设计与业务系统对接的高效敏捷推理接口,支持业务规模化扩展;根据业务需求优化模型性能,完成模型压缩、量化、蒸馏等技术落地;解决实际场景中的长尾问题,提升算法鲁棒性和泛化能力
负责VLA/VLA模型训练,探索具身数据大规模预训练方法;优化Action数据动作表示和监督方法,探索具身模型scaling law,在真机任务上形成可量化的成功率收益;负责动作表示与生成策略的设计与优化
与客户层级深入沟通,促成业务合作,负责签单结果达成,作为项目一线跟踪者全面掌握招标时间、项目负责人及领导层信息并制定相应计划;与售前团队共同筛选和优化商机,合理分配和利用资源,重点支持对产品PMF有帮助的项目,及时传递客户需求并协调内部资源解决推进问题
负责大语言模型、多模态模型的推理引擎搭建、优化与线上落地,支撑高并发、低延迟的模型服务;基于vLLM、TensorRT-LLM、SGLang、LightLLM等主流推理框架进行性能调优,并探索推测性解码、前缀缓存等前沿加速技术
跟进大模型商业化项目的全生命周期,确保项目按时、按质、按预算交付;制定并执行详细的项目计划,跟踪进度,协调各方资源;与销售、市场、客户支持团队协作,制定商业化策略,推动产品在不同市场的成功推广
负责审核与公司主营业务相关的中、英文业务合同,处理业务部门法律咨询;负责针对人工智能、数据等合规问题提供法律意见及解决方案;对公司内部流程和制度提出合理化建议,主导或协同推进涉及法务的业务流程优化
深入产品、技术及业务板块进行行业及产品研究,将技术能力转化为客户可感知的解决方案与业务价值;制定内容营销计划,落地白皮书、案例解读、评测及对比稿等输出,输出基础市场物料;统筹新媒体、社群、线下活动、业务拓展等全渠道内容输出与投放,提升传播效果
负责法律项目AI产品规划和设计,结合用户需求与大模型技术制定创新方案;推动大模型技术在法律相关业务场景和功能模块中的实际应用,提升产品竞争力;深入调研、抽象用户需求,分析数据,与研发、设计团队紧密合作确保高品质产品落地
主导数据体系建设,负责世界模型(World Model)训练数据的全链路规划与建设,将行业领先的视频生成数据经验落地到世界模型训练中;数据与模型协同设计(Co-design),深入理解模型架构与训练逻辑,根据模型反馈动态调整数据配比,反向对模型结构设计、Loss权重分配提出优化方案
围绕各类科研项目的流程体系、要求规范开展系统性调研与分析,形成研究报告或知识沉淀并持续更新;协助推进科研项目从筹划、立项、申报、执行到结案的全流程,负责项目资料撰写、整理与内部管理事务
负责AI算力调度平台核心服务的设计、开发与持续演进,支撑模型训练、研发调试、镜像管理、数据流转等关键场景;基于Kubernetes/Volcano构建资源管理、项目配额、任务调度、队列治理、优先级与抢占等核心能力,持续提升GPU资源利用率与平台吞吐能力
负责法律行业大模型商业化项目全生命周期管理,统筹项目从启动、规划、执行到交付的全流程,确保项目严格按照时间节点、质量标准及预算要求落地交付,保障客户满意度;制定科学、可落地的详细项目计划,精准跟踪项目进度,及时识别并解决项目执行中的风险与瓶颈,协调内外部资源(技术、销售、市场等),保障项目高效推进
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
负责智能座舱内大模型应用(如智能语音助手、场景化服务推荐、内容生成、个性化座舱等)的产品规划、路线图制定和版本管理;深入分析行业趋势、竞争格局和用户需求,挖掘大模型在车载场景下的核心价值点和创新机会,定义具有竞争力的产品特性
研究并跟踪国内外最新的⼤模型技术进展,搭建和维护科学、⾼效、可扩展的模型评测体系;深⼊参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态及前沿技术的能力定量分析;分析评测结果,挖掘模型潜在瓶颈并提出改进建议,持续提升模型质量与用户体验
调研AI行业市场,协助完成商业模式可行性分析、市场空间测算及盈利模型搭建;协助对接投资人、律所等外部机构,参与项目沟通会并整理关键决策纪要;负责融资相关核心文件的处理与流程,确保机密文件的安全与高效流转
端侧语言模型及多模态模型的推理部署与落地;异构硬件(GPU/DSP/NPU)性能调优与内存管理;深入研究各主流芯片厂商技术栈演进;推理框架、工具链及跨平台构建系统的开发与优化;模型量化、KV Cache管理与端侧推理优化
负责文本和多模态大模型的研发与应用工作;探索SFT(监督微调)、RL(强化学习)等核心训练技术;推进Agent/Multi-Agent智能体架构设计与应用落地;研究RAG(检索增强生成)相关技术方案
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界领先性能
构建和优化端到端智能系统,覆盖意图识别、多轮问答改写、知识检索、内容生成与用户偏好对齐,持续提升交互体验;参与对话式AI产品的全流程研发,探索大模型在教育等垂直领域的创新应用,并推动技术落地
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、入库、清洗、观测、挖掘等环节;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括但不限于数据采集、数据入库、数据清洗、数据观测、数据挖掘等环节;参与训练数据全生命周期管理体系建设,支撑多模态大模型场景下海量训练数据的高效读取,提升多模态大模型训练的工程效率
根据用人需求筛选简历并协调面试安排;跟进候选人面试流程,结合面试情况进行数据统计,维护各渠道招聘数据;组织策划文化活动,包括员工关怀、生日会、团建等企业内部活动,增强员工归属感,提升组织凝聚力
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;开展多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
参与VoxCPM语音大模型研发,负责语音模型能力研发和效果提升;探索语音大模型在实际场景中的应用落地,解决应用落地过程中的前沿问题;深入调研音频和大模型领域前沿技术,参与语音大模型前沿技术研发
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;开展多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、数据入库、数据清洗、数据观测、数据挖掘等环节;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系,确保数据有效提升模型基础能力
协同梳理基础模型技术的成果进展与产品亮点,挖掘具有传播价值的话题;完成有趣的图文、视频内容制作;紧跟海内外科技圈最新行业资讯,围绕技术相关热点进行头脑风暴;面向目标读者群进行内容互动;协助媒体联络与沟通,参与技术传播项目
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
常规招聘流程推进:发布招聘信息、寻访与筛选简历、邀约面试、跟进offer及入职流程;Top Talent寻访:搜寻与整理目标公司及院校的核心人才mapping信息;员工体验优化:梳理、推进并逐步优化新员工入职流程,及时发现并处理员工的人力和行政相关问题
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练;探索模型高效结构、多模态scaling law、数据配比及性能优化;参与多模态大模型的训练加速和高效部署,包括系统调优、硬件适配等工作
协同梳理基础模型技术的成果进展与产品亮点,挖掘具有传播价值的话题,完成图文、视频等内容制作;紧跟海内外科技圈最新行业资讯,围绕技术相关热点进行头脑风暴,面向目标读者群进行内容互动;协助媒体联络与沟通,参与技术传播项目
参与长文本大语言模型的研发、部署与微调工作,包括功能实现、性能优化、系统调优及硬件适配;开展模型架构优化相关研发,提升模型训练与推理效率;根据业务需求复现相关自然语言处理算法;参与前沿算法与应用的研究工作
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、入库、清洗、观测、挖掘等环节;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系,确保数据有效提升模型基础能力
参与MoE模型的研发、部署与微调,负责功能实现、性能优化、系统调优及硬件适配等工作;开展模型架构优化相关研发,提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责大模型预训练加速算法的研究与优化,涵盖MoE、多模态、创新架构等方向;针对MoE架构进行专项优化,包括Expert并行、负载均衡、通信优化等核心问题;研究并优化多模态模型(Vision-Language、Audio-Language等)的训练效率
面向GPU/昇腾架构开展算子性能画像、热点定位与优化,持续提升吞吐与时延稳定性;结合训练与推理场景,协同框架与编译链路进行内核调优、算子融合、内存访问与并行策略优化;建设性能基线与度量方法,沉淀可复用的优化范式与最佳实践,推动持续优化闭环
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型;开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进领域最新技术;通过技术创新和工程实践支撑模型能力提升
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
参与长文本模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
开展强化学习算法研究与开发工作;深入研究PPO、GRPO等前沿强化学习算法并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;大规模应用强化学习技术,提升模型的长思考能力、通用能力和Agent能力
根据特定场景(包括但不限于数学代码、长文本、科学领域等)进行有效预训练数据的筛选,并开展数据合成工作;根据需求进行模型对齐训练(包括SFT与RLHF),验证模型效果;实现准确的数据质量评估,建立完善的数据质量评估体系
根据特定场景(包括但不限于数学代码、长文本、科学领域等)进行有效预训练数据的筛选,并开展数据合成工作;根据需求进行模型对齐训练(包括SFT与RLHF),验证模型效果;实现准确的数据质量评估,建立完善的数据质量评估体系
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责动作表示与生成策略,并在真机任务上形成可量化收益;探索并落地空间感知与定位能力,以及视触觉、力矩等多源感知融合;熟悉VLM相关视觉编码器探索;负责末端执行器、关节、传感器方案的需求定义与原型迭代,支撑新技能的可学习与可评测
根据特定场景(包括但不限于基础模型、长文本、多模态等),进行有效数据的挖掘和构造,从数据侧赋能下游大语言模型;根据需求复现相关自然语言处理与数据处理算法与开源模型性能;参与前沿算法与应用的研究
研究和设计大模型的微调训练算法和推理算法适配,并针对实际场景进行效果和效率方面的优化;负责特定功能方向的大模型微调训练,并交付到实际业务场景;研究和设计微调模型的实际效果提升办法;跟踪最新的学术研究,将最新的研究成果应用到实际问题中去
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
根据特定场景(包括但不限于数学代码、长文本、科学领域等),进行有效预训练数据的筛选,并开展数据合成工作;根据需求进行模型对齐训练(包括SFT与RLHF),验证模型效果;实现准确的数据质量评估,建立完善的数据质量评估体系
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(强化学习对齐、Prompt工程等)的能力定量分析
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
根据特定场景(包括但不限于基础模型、长文本、多模态等),进行有效数据的挖掘和构造,从数据侧赋能下游大语言模型;根据需求复现相关自然语言处理与数据处理算法与开源模型性能;参与前沿算法与应用的研究
开展强化学习算法的研究与开发工作;深入研究PPO、GRPO等强化学习前沿算法并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;大规模应用强化学习技术,提升模型的长思考能力、通用能力和Agent能力
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
根据特定场景(包括但不限于数学代码、长文本、科学领域等),进行有效预训练数据的筛选,并开展数据合成工作;根据需求进行模型对齐训练(包括SFT与RLHF),验证模型效果;实现准确的数据质量评估,建立完善的数据质量评估体系
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
根据特定场景(包括但不限于基础模型、长文本、多模态等),进行有效数据的挖掘和构造,从数据侧赋能下游大语言模型;根据需求复现相关自然语言处理与数据处理算法与开源模型性能;参与前沿算法与应用的研究
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进领域最新技术,通过技术创新和工程实践支撑模型能力提升
跟进大模型商业化项目的全生命周期,确保项目按时、按质、按预算交付;制定并执行详细的项目计划,跟踪进度,协调资源;与销售、市场、客户支持团队协作,制定商业化策略,推动产品在不同市场的成功推广
研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(强化学习对齐、Prompt工程等)的能力定量分析
研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析
基于现有强化学习算法框架,建设并部署支撑RL训练的高效稳定基础设施;优化强化学习训练流程与框架,持续提升训练效率和模型性能;与团队协作,推动Infra方案落地,保障强化学习模型的高效训练
负责真机与仿真数据的处理、质量验证及评测体系建设;收集和清洗大规模预训练数据,支持模型训练需求;完成商用及开源机械臂系统的集成与真机评测;支持 Teleop 数据采集流程与数据质量验证;在 Isaac Sim/MuJoCo 仿真环境中搭建任务场景并生成训练数据
参与大模型训练数据的构建,包括数据采集、数据清洗、数据增强,搭建高效的分布式数据pipeline;参与大语言模型的数据质量提升,包括数据风控策略、异常数据检测、数据修复、特定领域数据扩充
负责开拓有大模型相关需求企业的合作关系,精准识别关键决策人,建立并维护高价值的客户关系网络,深度挖掘客户需求;独立负责从线索挖掘、商机判断、方案呈现、价值论证、商务谈判到合同签订的完整销售流程
结合公司标杆客户案例,面向客户提供大模型售前解决方案,协助业务团队实现业绩增长;配合销售团队进行大模型售前交流、POC验证、解决方案编写、招投标技术方案等工作;挖掘、洞察行业共性需求,调研市场优质方案和产品,帮助产品团队打磨更具市场化的创新应用
参与大规模强化学习训练框架的设计与开发,支持千亿参数级模型的Post-training阶段;深入分析训练与推理过程中的性能瓶颈,针对计算、显存和通信进行优化,提升训练吞吐量和资源利用率
负责多模态大模型预训练、SFT、对齐等各阶段的模型开发与训练;探索模型高效结构、多模态scaling law、数据配比及性能优化;参与多模态大模型的训练加速和高效部署,包括系统调优、硬件适配等工作
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、数据入库、数据清洗、数据观测、数据挖掘等环节;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系,确保数据有效提升模型基础能力
深度参与从基础模型到创新应用的全链路开发,通过评测反馈直接驱动模型微调(SFT)、偏好对齐(RLHF/DPO)及架构改进,确保技术领先性;设计、搭建并维护可扩展的模型评测基准与自动化平台,涵盖基础能力、指令遵循、长文本及安全性等多维度
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、数据入库、数据清洗、数据观测、数据挖掘等环节;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系,确保数据有效提升模型基础能力
负责大规模分布式训练和推理的基础架构设计、开发与优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;开展多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
开展算法研究与开发工作;深入研究强化学习领域的前沿算法(PPO、GRPO等)并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;大规模应用强化学习,以提升模型的长思考能力、通用能力、Agent能力等
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;开展多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责中大型项目中的复杂模块开发,确保功能按时、稳定上线;快速定位和解决开发中、测试阶段及线上的各类前端技术问题,如性能瓶颈、兼容性难题、交互逻辑缺陷等;持续对负责的项目模块进行性能优化(加载速度、运行时流畅度)和用户体验打磨
阅读、理解并参与主流开源项目(如llama.cpp、Ollama、vllm等)的源码分析与功能扩展;编写高性能代码,优化模型运行效率与内存占用;对多模态大语言模型有基本了解,有使用经验或参与过相关项目
参与模型量化感知训练(QAT),主要涉及QAT风洞及QAT训练等工作;基于公司需求进行QAT相关算法的开发及训练;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究;自然语言处理、机器学习及相关专业,有相关的算法工程或科研经验
深入研究多说话人识别、BGM分离、声音事件检测、方言识别和语音识别等领域的最新技术和算法,评估现有模型的有效性并提出改进建议;负责所选方向的模型设计与实现,进行实验与调优,确保模型性能达到预期标准
负责大模型量化算法的研究和实现,包括PTQ(训练后量化)和QAT(量化感知训练)等方向;探索低比特量化(INT2/INT4/MxFP4等)在大语言模型和多模态模型上的应用,平衡精度与效率
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、数据入库、数据清洗、数据观测、数据挖掘等环节;参与训练数据全生命周期管理体系建设,支撑多模态大模型场景下海量训练数据的高效读取,提升多模态大模型训练的工程效率
参与MoE模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责保障大规模AI集群的计算、网络和存储系统的稳定运行,监控、识别并解决各类线上问题;协助IDC和各类软硬件供应商完成大规模集群的部署、联调、上线运行;建设大规模集群的运维能力和运维体系,并对平台客户提供相关技术支持
参与多模态大模型(Omni-modal)的前沿算法研究;重点聚焦MiniCPM-o模型的训练与其他前沿模型的复现工作;参与多模态大模型相关数据的构建与生产;负责模型评测,推动模型持续迭代优化
参与VLA/Policy模型的训练、微调与评测,包括数据准备、训练脚本维护、指标分析与误例归因;协助搭建与维护真机评测/闭环链路,将模型输出对接到控制接口,完成端到端跑通与稳定性排查
负责预训练基础设施的整体架构设计与技术规划,主导Infra方案的落地实施;搭建并优化大规模预训练系统,确保千/万卡级别集群的高效稳定运行;主导分布式训练框架的选型、优化与二次开发,持续提升训练效率与资源利用率
配合算法/策略团队,参与大模型相关数据工作;执行数据处理等基础工作;根据执行反馈,参与评测方法优化工作;根据指定标准完成各类产品效果评测工作;进行产品优化方向分析;大学本科及以上学历;实习周期不少于3个月,每周实习时间不少于4天
深入研究多说话人识别、BGM分离、声音事件检测、方言识别和语音识别等领域的最新技术和算法,评估现有模型的有效性并提出改进建议;负责所选方向的模型设计与实现,进行实验与调优,确保模型性能达到预期标准
针对工具使用、代码生成、长程Agent任务(如规划、搜索、浏览器/计算机操作)等复杂场景,主导SFT、RLHF及RLVR等核心算法的实验与迭代,实现模型能力的突破;主导特定高级任务的高质量数据闭环构建,负责合成查询、合成与验证执行轨迹、过滤与标注数据,以及构建高性能的验证器/奖励模型
负责强化学习训练平台的整体架构设计与技术规划,主导Infra方案的落地实施;搭建并优化RLHF/RL训练基础设施,确保强化学习训练的高效稳定进行;主导强化学习框架的选型、优化与定制开发,持续提升训练效率和模型性能
处理并构建世界模型训练数据:视频/轨迹切片、对齐、清洗、统计与可视化(支持action-conditioned格式);参与训练/调试世界模型核心模块:视频tokenizer/latent表征、latent dynamics(预测/生成/rollout)
处理并构建世界模型训练数据:视频/轨迹切片、对齐、清洗、统计与可视化(支持action-conditioned格式);参与训练/调试世界模型核心模块:视频tokenizer/latent表征、latent dynamics(预测/生成/rollout)
参与公司层面品牌传播和公关项目的创意构思和设计执行;根据项目需求,进行平面设计、网页设计、社交媒体宣传图等相关设计工作;对品牌形象和视觉传达进行维护和优化,确保一致性和专业性;协助团队完成其他相关设计支持和辅助工作
负责公司大模型产品的Android客户端研发;根据功能需求和设计方案进行开发,完成代码的编写和调试工作;参与产品需求分析,设计系统技术方案,核心代码开发和系统调优;参与各专项技术调研,改进系统性能与稳定性
参与长文本模型的研发、部署与微调,涵盖功能实现、性能优化、系统调优及硬件适配等工作;开展模型架构优化相关研发,提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
负责法律相关场景的大模型数据整理和研究工作;协助构建大模型数据评测体系;开展大模型竞品跟踪调研;协助梳理大模型场景需求,推动需求场景在项目中的落地实现;具备一定的大模型认知基础;法律专业基础知识扎实,有法院、律所实习经验者优先
追踪on-policy蒸馏方向前沿研究,复现并验证算法;推动蒸馏算法工业级应用,解决落地问题并优化算法;维护后训练框架,提升其性能与稳定性;计算机、AI等相关专业本科及以上学历;熟悉大模型推理框架(vLLM / SGLang)和强化学习框架 VeRL / MILES
负责并推进美国、英国等英语区发达国家的用户访谈与调研,收集用户反馈,了解用户需求;跟进用户在Instagram、Facebook等社交平台上的反馈,维护用户社群,并根据用户声音提出优化建议
协助法律业务产品运营日常工作,包括内容整理、用户反馈收集、数据统计与复盘;参与社群/用户运营,维护用户活跃,跟进用户问题;协助文案撰写、宣传素材整理;跟进产品迭代,整理需求、记录问题、输出运营报告
协助产品团队进行产品的用户界面(UI)设计工作,包括但不限于网页、移动应用等产品的界面设计;参与产品的交互设计讨论,从视觉设计的角度提出合理化建议,优化产品的用户体验;协助产品经理进行产品需求的收集、整理和分析,参与市场调研和用户访谈,了解用户需求和市场动态,为产品的规划和设计提供依据
参与模型风洞的构建,主要涉及优化器实验、数据风洞、scaling实验等工作;基于公司需求进行模型风洞相关算法的开发;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究;自然语言处理、机器学习及相关专业,有相关的算法工程或科研经验
参与大规模预训练语言模型的预训练工作;负责Scaling Law构建、性能优化及硬件适配等工作;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究;自然语言处理、机器学习及相关专业背景
负责构建面向大模型训练的高质量数据体系,主导语音、视觉、多模态数据的采集、存储、清洗及特征工程;探索基于生成式模型的合成数据构建,包括数据增强、对抗生成等技术;设计与实施数据质量评估体系,开发高质量、高知识密度的数据筛选机制
负责文本基座(MoE/Dense)训练与推理管线的深度定制;集成并优化Megatron、vLLM、SGLang等核心框架;通过CUDA/Triton算子开发与量化压缩,解决长文本通信与计算瓶颈
负责文本基座(MoE/Dense)训练与推理管线的深度定制与全栈架构优化;集成并优化Megatron、vLLM、SGLang等核心分布式框架;通过CUDA/Triton算子开发与量化压缩技术解决长文本通信与计算瓶颈
研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析
深入个人终端业务场景,设计高效的文本/多模态大模型解决方案,驱动端侧模型落地应用;负责模型训练与调优,基于终端业务需求,通过预训练、SFT、RL等技术快速迭代优化模型性能;跟踪前沿技术发展,探索新算法与新模型并应用于实际业务,推动产品持续创新
开展强化学习算法研究与开发工作;深入研究PPO、GRPO等前沿强化学习算法并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;大规模应用强化学习技术,提升模型的长思考能力、通用能力和Agent能力
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
构建和优化端到端智能系统,覆盖意图识别、多轮问答改写、知识检索、内容生成与用户偏好对齐,持续提升交互体验;参与对话式AI产品的全流程研发,探索大模型在教育等垂直领域的创新应用,并推动技术落地
针对基础模型、长文本、多模态等特定场景,进行有效数据的挖掘和构造,从数据侧赋能下游大语言模型;根据需求复现相关自然语言处理与数据处理算法与开源模型性能;参与前沿算法与应用的研究;自然语言处理、机器学习、大数据处理及相关专业,3年以上相关工作经验
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
研究和设计大模型的微调训练算法和推理算法适配,针对实际场景进行效果和效率优化;负责特定功能方向的大模型微调训练,并交付到实际业务场景;研究和设计微调模型的实际效果提升办法;跟踪最新的学术研究,将最新研究成果应用到实际问题中
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
支持公司智能体相关项目研发;优化模型能力以满足Agent应用场景的需求,搭建Agent框架,工作内容包括算法开发、模型训练、数据处理、服务部署等;从全流程优化RAG效果,包括文件处理、文本切分、语义检索、检索生成、长文理解、引用等
基于开源及采集数据进行清洗,包括内容抽取、启发式过滤、去重、模型过滤低质数据等,优化清洗pipeline以提升预训练数据质量;建立数据标签体系,针对不同标签数据进行质量提升和数据合成
深度参与从基础模型到创新应用的全链路开发,通过评测反馈直接驱动模型微调(SFT)、偏好对齐(RLHF/DPO)及架构改进;设计、搭建并维护可扩展的模型评测基准与自动化平台,涵盖基础能力、指令遵循、长文本及安全性等多维度
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进领域最新技术,通过技术创新和工程实践支撑模型能力提升
负责复杂业务需求的数据模型设计与开发,确保数据质量和系统稳定性;参与数据平台的架构设计与优化,提升数据处理效率和系统性能;负责数据管道的建设与维护,包括ETL流程的设计与实施;与数据科学团队协作,将数据转化为业务洞察,支持决策制定
参与大规模预训练语言模型的预训练工作;负责Scaling Law构建、性能优化、硬件适配等技术工作;根据业务需求复现相关自然语言处理算法;参与前沿算法与应用的研究工作;自然语言处理、机器学习及相关专业背景
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
负责大模型预训练加速算法的研究与优化,涵盖MoE、多模态、创新架构等方向;针对MoE架构进行专项优化,包括Expert并行、负载均衡、通信优化等核心问题;研究并优化多模态模型(Vision-Language、Audio-Language等)的训练效率
参与长文本模型的研发、部署与微调,负责功能实现、性能优化、系统调优及硬件适配等工作;开展模型架构优化相关研发,提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
参与MoE模型的研发、部署与微调,负责功能实现、性能优化、系统调优及硬件适配等工作;开展模型架构优化相关研发,提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
根据特定场景(包括但不限于数学代码、长文本、科学领域等),进行有效预训练数据的筛选,并开展数据合成工作;根据需求进行模型对齐训练(包括SFT与RLHF),验证模型效果;实现准确的数据质量评估,建立完善的数据质量评估体系
负责大模型训练数据的清洗工作,针对文本、多模态等数据类型,设计高效的去重算法与异常数据过滤方案,剔除无效、冗余数据,提升数据集纯净度;开展多源异构数据的整合工作,打通不同渠道、不同格式的数据壁垒;运用聚类算法对数据进行分类梳理,挖掘数据内在关联,构建结构化、体系化的训练数据池
负责GPU算力平台的开发、运维、监控告警与故障排查,保障平台稳定运行;开发和维护运维自动化工具,提升运维效率,降低人工干预成本;参与算力平台的容量规划、性能调优与资源调度优化;搭建和完善监控体系、日志系统与故障诊断平台
负责面壁智能的对齐算法和强化学习研发,提升用户体感;负责AIGC算法方向的中长期技术规划,制定相应的技术发展方向和计划,使系统体系化并具有前瞻性,并在具体场景中成功应用;应用机器学习、自然语言处理、视频理解和语音合成等技术处理海量数据,挖掘潜在关联,分析特征,搭建模型,优化AIGC结果,高效解决用…
围绕科研项目流程体系与规范开展系统性调研分析,形成研究报告并持续更新知识沉淀;协助推进科研项目从筹划、立项、申报、执行到结案的全流程管理,负责资料撰写与内部事务;管理公司核心项目进程,配合相关部门、科研机构及合作伙伴的沟通对接,支持访问接待与会议筹备
基于现有强化学习算法框架,建设并部署支撑RL训练的高效稳定基础设施;优化强化学习训练流程与框架,持续提升训练效率和模型性能;与团队协作,推动Infra方案落地,保障强化学习模型的高效训练
研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析
负责智能座舱SDK核心功能开发,包括意图识别、语义理解、图像/视频识别等模块;维护和优化SDK架构,提升代码质量和可维护性;实现多领域服务匹配(车控、导航、音乐、电话等);负责SDK在Android车机平台的集成开发
负责端侧设备上部署和集成大模型,确保稳定高效运行;负责业务系统与端侧大模型推理的高效敏捷接口,支持业务可扩展性;根据业务需求,优化模型性能,完成模型压缩、量化、蒸馏等技术落地;解决实际场景中的长尾问题,提升算法鲁棒性和泛化能力
负责公司法律业务、智能车机、AI教育等业务线的业务研发与设计工作;对现有技术架构进行重构、优化和维护;负责核心模块开发、代码评审,把控项目质量,保障系统平台的高可用、高性能;负责解决项目中的技术难题,进行关键技术难点攻关
负责构建面向大模型训练的高质量数据体系,主导语音、视觉、多模态数据的采集、存储、清洗及特征工程,探索基于生成式模型的合成数据构建(如数据增强、对抗生成等);设计与实施数据质量评估体系,开发高质量、高知识密度的数据筛选机制,构建数据质量-模型表现的闭环验证系统
设计和优化产品的私有化部署方案,支持物理机、虚拟机、私有云等多种客户环境;负责大语言模型(LLM)的私有化部署和优化,包括模型加载、推理服务配置和性能调优;部署和维护RAG(检索增强生成)系统,包括向量数据库、知识库管理、文档处理管道等组件
负责产品全流程的UI/UX设计工作,从用户需求分析、交互逻辑梳理到视觉落地,独立将业务需求转化为高质量的交互设计方案(如线框图、原型图等),并推动方案落地;深度挖掘用户需求与使用场景,通过用户研究(如访谈、可用性测试等)和数据反馈,优化产品体验,解决核心体验痛点,对最终用户体验效果负责
设计、搭建并维护可扩展的模型评测基准与平台;对文本模型、多模态模型以及相关应用场景的效果进行定量分析与评测;基于评测数据精准定位模型瓶颈,提出切实可行的改进建议;实现评测工具与流程的自动化,打造业内领先的评测标准与方法论
深度参与公司财务流程的梳理与优化,协助上级建立健全符合现代企业管理要求的内部控制体系;对接业务部门,对合同签订、费用报销、预算执行等进行财务合规性审核,定期组织内部沟通会议,推动业财数据口径的一致性
参与AI Agent相关产品的后端研发,快速搭建应用;持续在各种场景下探索,利用AI能力提升和优化产品体验,提升工程效率;参与各专项的技术调研,新技术引入等前瞻项目,推动适合的技术应用于新产品的开发,解决实际问题
研发基于大模型(LLM)的内容安全检测算法,包括有害信息识别、敏感话题过滤、虚假信息检测等;设计多模态(文本、图像、视频)内容安全检测方案,提升模型对不良内容的识别能力;探索大模型安全对齐(Alignment)技术,包括SFT、RLHF等多阶段优化模型生成内容的安全性
跟进大模型商业化项目的全生命周期,确保项目按时、按质、按预算交付;制定并执行详细的项目计划,跟踪进度,协调资源;与销售、市场、客户支持团队协作,制定商业化策略,推动产品在不同市场的成功推广
参与模型风洞的构建,主要涉及优化器实验、数据风洞、scaling实验等工作;开展模型风洞实验,为大规模模型训练提供指导;参与量化感知训练(QAT),主要涉及QAT风洞实验及QAT训练方法的优化
负责大模型在垂直领域的应用及研发,包括空间理解、思维博弈场景;基于应用场景设计实现数据合成、模型微调和模型评估等解决方案;基于Agent/Multi-Agent、RAG等技术构建代码框架,推动模型落地应用
面向GPU/昇腾架构开展算子性能画像、热点定位与优化,持续提升吞吐与时延稳定性;结合训练与推理场景,协同框架与编译链路进行内核调优、算子融合、内存访问与并行策略优化;建设性能基线与度量方法,沉淀可复用的优化范式与最佳实践,推动持续优化闭环
研究和设计大模型的微调训练算法和推理算法适配;针对实际场景进行效果和效率方面的优化;负责特定功能方向的大模型微调训练,并交付到实际业务场景;研究和设计微调模型的实际效果提升办法;跟踪最新的学术研究,将最新的研究成果应用到实际问题中
面向GPU/昇腾架构开展算子性能画像、热点定位与优化,持续提升吞吐与时延稳定性;结合训练与推理场景,协同框架与编译链路进行内核调优、算子融合、内存访问与并行策略优化;建设性能基线与度量方法,沉淀可复用的优化范式与最佳实践,推动持续优化闭环
负责智能座舱SDK核心功能开发,包括意图识别、语义理解、图像/视频识别等模块;维护和优化SDK架构,提升代码质量和可维护性;实现多领域服务匹配(车控、导航、音乐、电话等);负责SDK在Android车机平台的集成开发
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
基于技术趋势与用户研究,定义AI硬件产品的核心功能与体验;撰写产品需求文档,规划产品路线图,精准定义硬件规格与性能指标;驱动算法、硬件、结构团队紧密协作,解决端侧部署与量产挑战;拉通研发至市场全流程,确保产品高质量、按时上市与成功迭代
独立设计、实现并维护针对多样化、不稳定外部数据源的爬虫系统;构建并维护具备重试、去重、容错与监控特性的数据采集管道;在Kubernetes和云基础设施上部署并管理大规模分布式爬取系统;在采集管道中合理使用Postgres、Redis等中间件,确保可靠性并规避常见使用误区
统筹前后端、算法工程团队的研发管理工作,负责需求拆解、排期规划、任务分配与进度把控,建立敏捷开发机制,提升团队交付效率;衔接产研团队,保障业务目标与技术落地协同推进;主导AI教育平台技术架构优化与重构,重点保障系统高并发场景稳定性,支撑未来多所学校规模化使用,规避系统宕机、响应延迟等问题
参与模型风洞的构建,主要涉及优化器实验、数据风洞、Scaling实验等工作;开展模型风洞实验,为大规模模型训练提供科学指导;参与量化感知训练(QAT),负责QAT风洞实验及训练方法的优化
负责多模态数据管线平台的设计、开发与运维,支持文本、图像、音频、视频等非结构化数据的采集、处理、存储与计算;在数据管线平台上进行计算任务的深度优化,包括性能、资源利用率、稳定性与成本优化
根据特定场景(包括但不限于基础模型、长文本、多模态等),进行有效数据的挖掘和构造,从数据侧赋能下游大语言模型;根据需求复现相关自然语言处理与数据处理算法与开源模型性能;参与前沿算法与应用的研究
建设革命性的AI教育产品,运用AI技术赋能「大规模因材施教」,负责产品设计和数据分析等工作;与业务团队紧密协作,理解客户需求,传递产品价值,落实有效需求,持续跟进关键数据指标和用户反馈,持续迭代优化产品
设计端侧AI Agent软件架构,实现感知、规划、决策、记忆管理等核心模块;将全模态/多模态模型部署到Jetson、RK、高通等端侧芯片,完成量化与性能优化;使用TensorRT/ONNX/TFLite等框架进行推理部署,保障低时延与稳定性
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
建设革命性的AI教育产品,用AI技术赋能「大规模因材施教」,负责产品设计和数据分析等工作;与业务团队紧密协作,理解客户需求,传递产品价值,落实有效需求,持续跟进关键数据指标和用户反馈,持续迭代优化产品
负责法律项目AI产品规划和设计,结合用户需求与大模型技术制定创新方案;推动大模型技术在法律相关业务场景和功能模块中的实际应用,提升产品竞争力;深入调研、抽象用户需求,分析数据,并与研发、设计团队紧密合作确保高品质产品落地
负责车端大模型应用架构设计与落地,重点围绕舱内外视觉理解、意图识别、哨兵、记忆、Agent等应用场景;协调算法、工程、测试及外部合作方(主机厂/其他供应商等),完成工程开发;优化推理效率、控制系统资源占用,确保项目稳定交付
负责端侧大模型量化技术的研发,跟踪大模型量化和端侧部署领域的最新动态,探索前沿技术并应用于实际业务;针对具体业务场景和端侧硬件(如手机、汽车),进行模型压缩、蒸馏、稀疏化等优化,达成极致性能
负责大模型训练数据的清洗工作,针对文本、多模态等数据类型,设计高效的去重算法与异常数据过滤方案,剔除无效、冗余数据,提升数据集纯净度;开展多源异构数据的整合工作,打通不同渠道、不同格式的数据壁垒;运用聚类算法对数据进行分类梳理,挖掘数据内在关联,构建结构化、体系化的训练数据池
在端侧设备上规划与落地AI能力,负责产品设计和数据分析;与业务团队紧密协作,理解客户需求,传递产品价值,完成需求拆解、技术评估、方案设计、交付推进与质量把控;持续跟进关键数据指标和用户反馈
负责动作表示与生成策略,并在真机任务上形成可量化收益;探索并落地空间感知与定位能力,以及视触觉、力矩等多源感知融合;熟悉VLM相关视觉编码器探索;负责末端执行器、关节、传感器方案的需求定义与原型迭代,支撑新技能的可学习与可评测
设计、搭建并维护可扩展的模型评测基准与平台;对文本模型、多模态模型以及相关应用场景的效果进行定量分析与评测;基于评测数据精准定位模型瓶颈,提出切实可行的改进建议;实现评测工具与流程的自动化,打造业内领先的评测标准与方法论
实现和维护可复用的库、模块和平台,用于大规模数据采集与处理;根据系统设计,构建基础设施组件,如代理服务、镜像管道、可靠调度器及中间件抽象层;确保采集管道及支撑系统在数百PB至ZB规模下的可靠性、可扩展性和效率
负责AI Agent在端侧的整体软件架构设计与模块实现,包括感知、规划、决策、工具调用、记忆管理等核心功能;设计与实现多模态数据采集、缓存、预处理管线,支持视频/语音/传感器数据的高效处理
参与大规模预训练语言模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;基于公司业务场景需求进行NLP相关研发;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
跟进大模型技术发展动态,结合业务需求制定技术落地路径;推动算法团队与工程团队协作,实现大模型技术应用;统筹项目执行全过程,协调各方资源;确保技术方案按时交付并达到预期目标;本科及以上学历,计算机、人工智能、软件工程等相关专业优先
负责开拓和维系与各级人大、政府法制办、司法行政部门、政策研究室等立法机构的合作关系;建立并维护法律信息数据库、知识管理平台、智库等知识服务类企业的客户关系网络;精准识别关键决策人,深度挖掘客户需求,建立高价值客户关系
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责文本和多模态大模型的研发与应用,涵盖SFT、RL、Agent/Multi-Agent、RAG等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责保障大规模AI集群的计算、网络和存储系统的稳定运行,监控、识别并解决各类线上问题;协助IDC和各类软硬件供应商完成大规模集群的部署、联调、上线运行;建设大规模集群的运维能力和运维体系,并对平台客户提供相关技术支持
负责多模态大模型指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能和Agent领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地
负责公司产品的内容合规与安全,配合业务迭代节奏,制定合理有效的安全策略,保障平台安全;负责公司安全平台及评测系统的搭建,参与产品规划、需求管理全流程,提升安全审核业务全流程效率;负责端侧大模型的内容安全产品策略制定,包括机审模型标签与策略体系,根据大模型生成内容的风险场景,完善符合业务需求的安全能力
参与大模型预训练Infra框架的维护与迭代,协助保障训练系统的稳定性与可扩展性;参与MoE架构的训练优化工作,包括Expert并行、负载均衡、通信优化等方向;协助设计与优化并行策略(TP/PP/DP/EP/SP),提升大规模训练的吞吐量与资源利用率
参与高效注意力模型(包括但不限于线性注意力模型、状态空间模型、稀疏注意力模型)的研发、部署与微调工作;负责功能实现、性能优化、系统调优及硬件适配等技术工作;参与长文本对齐算法的研发工作
负责真机与仿真数据的处理、质量验证及评测体系建设;收集和清洗大规模预训练数据,保障数据质量与多样性;完成商用及开源机械臂系统的集成与真机评测;支持Teleop数据采集流程搭建与数据质量验证
跟踪AI行业前沿动态,研究大模型Agent类产品;分析相关数据,访谈用户需求;设计产品方案并持续迭代优化;对生成式人工智能有强烈热情,善于使用各类AI工具;自驱力强,逻辑思维能力强,做事认真负责且有耐心
参与制定并执行投资者关系策略,建立和维护与投资者的良好沟通与协作关系;组织和参与投资者会议、路演等活动,有效地与潜在投资者沟通公司战略与目标;研究市场和行业趋势,为公司提供战略建议与支持
研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析
协同梳理基础模型技术的成果进展与产品亮点,挖掘具有传播价值的话题;完成有趣的图文、视频内容制作;紧跟海内外科技圈最新行业资讯,围绕技术相关热点进行头脑风暴;面向目标读者群进行内容互动;协助媒体联络与沟通,参与技术传播项目
跟踪AI行业前沿动态,研究大模型Agent类产品;分析相关数据,开展用户访谈;设计产品方案并持续迭代优化;对生成式人工智能有强烈热情,善于使用各类AI工具;自驱力强,逻辑思维能力强,做事认真负责且有耐心
面向GPU/昇腾架构开展算子性能画像、热点定位与优化,持续提升吞吐与时延稳定性;结合训练与推理场景,协同框架与编译链路进行内核调优、算子融合、内存访问与并行策略优化;建设性能基线与度量方法,沉淀可复用的优化范式与最佳实践,推动持续优化闭环
根据特定场景(包括但不限于数学代码、长文本、科学领域等)进行有效预训练数据的筛选,并开展数据合成工作;根据需求进行模型对齐训练(包括SFT与RLHF),验证模型效果;实现准确的数据质量评估,建立完善的数据质量评估体系
研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析
参与大语言模型的研发、部署、微调及评测工作;负责模型功能实现、性能优化、系统调优及硬件适配;基于公司业务场景需求进行模型算法相关研发;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
针对工具使用、代码生成、长程Agent任务等复杂场景,主导SFT、RLHF及RLVR等核心算法的实验与迭代;主导特定高级任务的高质量数据闭环构建,包括合成查询、验证执行轨迹、数据过滤与标注等
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
深入个人终端业务场景,设计高效的文本/多模态大模型解决方案,驱动端侧模型落地应用;负责模型训练与调优,基于终端业务需求,通过预训练、SFT、RL等技术,快速迭代优化模型性能;跟踪前沿技术发展,探索新算法与新模型,并应用于实际业务,推动产品持续创新
负责智能座舱内大模型应用(如智能语音助手、场景化服务推荐、内容生成、个性化座舱等)的产品规划、路线图制定和版本管理;深入分析行业趋势、竞争格局和用户需求,挖掘大模型在车载场景下的核心价值点和创新机会,定义具有竞争力的产品特性
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
负责多模态基础模型的强化学习相关算法工作,参与模型训练、调优和部署,确保算法的有效性和效率;多模态大模型强化学习技术的前瞻性探索,包括但不限于离线强化学习、多轮强化学习等方向;改进多模态大模型强化学习分布式工程框架,实现更高效的模型训练
、负责基础模型团队全流程招聘工作,深刻理解业务与人才画像,把握招聘需求,高质高效的为团队选拔和匹配人才;、优化招聘流程,包括但不限于发布招聘信息、简历筛选、安排面试、Offer沟通、招聘数据分析等,有效提升招聘转化率
、负责基础模型团队全流程招聘工作,深刻理解业务与人才画像,把握招聘需求,高质高效的为团队选拔和匹配人才;、优化招聘流程,包括但不限于发布招聘信息、简历筛选、安排面试、Offer沟通、招聘数据分析等,有效提升招聘转化率
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、入库、清洗、观测及挖掘;建立多模态数据的闭环验证体系(数据构造→模型训练→性能评测),确保数据有效提升模型能力
端侧智能系统开发:负责AI Agent在端侧的整体软件架构设计与模块实现(感知、规划、决策、工具调用、记忆管理等);端侧智能系统开发:设计与实现多模态数据(视频/语音/传感器)采集、缓存、预处理管线
算法研究与开发;深入研究强化学习领域的前沿算法(如PPO、GRPO等)并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;大规模应用强化学习,以提升模型的长思考能力、通用能力、Agent能力等
负责文本和多模态大模型的研发与应用,涵盖 SFT、RL、Agent/Multi;Agent、RAG 等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责文本和多模态大模型的研发与应用,涵盖 SFT、RL、Agent/Multi;Agent、RAG 等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责文本和多模态大模型的研发与应用,涵盖 SFT、RL、Agent/Multi;Agent、RAG 等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责产品全流程的UI/UX设计工作,包括用户需求分析、交互逻辑梳理和视觉落地;独立将业务需求转化为高质量的交互设计方案(如线框图、原型图等),并推动方案落地;深度挖掘用户需求与使用场景,通过用户研究和数据反馈优化产品体验
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
负责多模态大模型预训练、指令微调、偏好对齐等阶段的工作,包括数据观测、数据挖掘、模型迭代等环节;参与计算机视觉、自然语言理解、通用人工智能领域的前沿研究与开发;跟进业界最新技术和进展,结合实际场景进行落地,持续提升数据质量,挖掘数据价值
设计与构建支撑大模型研发的一站式数据平台,覆盖数据全生命周期管理;规划预训练、SFT、RLHF等阶段的数据采集、清洗、去重、标注、存储及版本管理架构;设计并实现支持高效操作的数据标签体系,赋能高质量数据集的高效构建、发现与复用
负责车端大模型应用架构设计与落地,重点围绕舱内外视觉理解、意图识别、哨兵、记忆、Agent等应用场景;协调算法、工程、测试及外部合作方(主机厂/其他供应商等),完成工程开发、优化推理效率、系统资源占用
参与VoxCPM语音大模型研发,负责语音模型能力研发和效果提升;探索语音大模型在实际场景中的应用落地,解决应用落地过程中的前沿问题;深入调研音频和大模型领域前沿技术,参与语音大模型前沿技术研发
探索AI时代背景下新型的组织形态、文化理念与管理模式,并在公司范围内推动落地,提升组织效能;搭建适配AI创业团队的人才发展体系,包括但不限于职级体系、梯队建设及领导力发展等;深入理解业务战略及组织特点,提供全模块的人力资源解决方案,支撑业务成功
负责华为设备上部署和集成大模型,确保稳定高效运行;负责业务系统与端侧大模型推理的高效敏捷接口,支持业务scalable;根据业务需求,优化模型性能,完成模型压缩、量化、蒸馏等技术落地;解决实际场景中的长尾问题,提升算法鲁棒性和泛化能力
根据特定场景(如数学代码、长文本、科学领域等)筛选有效预训练数据并进行数据合成;根据需求开展模型对齐训练(包括SFT与RLHF)并验证模型效果;建立准确的数据质量评估体系;参与前沿算法与应用的研究
参与MoE模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
参与MoE模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
参与长文本模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
参与AI Agent相关产品的后端研发,快速搭建应用;持续探索各类场景,利用AI能力优化产品体验并提升工程效率;参与技术调研与前瞻项目,推动新技术应用于产品开发;完成架构设计、业务逻辑开发及后端系统性能调优
设计和优化产品的私有化部署方案,支持多种客户环境(物理机、虚拟机、私有云等);负责大语言模型(LLM)的私有化部署和优化,包括模型加载、推理服务配置和性能调优;部署和维护RAG(检索增强生成)系统,包括向量数据库、知识库管理、文档处理管道等组件
参与大规模预训练语言模型的预训练,包括Scaling Law构建、性能优化及硬件适配;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究;自然语言处理、机器学习及相关专业背景,3年以上相关工作经验
闭环算法优化:深度参与从基础模型到创新应用的全链路开发,通过评测反馈直接驱动模型微调 (SFT)、偏好对齐 (RLHF/DPO) 及架构改进,确保技术领先性;构建科学评测体系:设计、搭建并维护可扩展的模型评测基准与自动化平台,涵盖基础能力、指令遵循、长文本及安全性等多维度
产出高质量技术内容(博客、教程、视频脚本);进行对外技术演讲,代表项目参与技术会议;推动与SGLang、vllm等主流框架的官方深度集成并提供技术支持;维护GitHub社区(PR/Issue管理)
负责智能座舱SDK核心功能开发,包括意图识别、语义理解、图像/视频识别等模块;维护和优化SDK架构,提升代码质量和可维护性;实现多领域服务匹配(车控、导航、音乐、电话等);负责SDK在Android车机平台的集成开发
跟进大模型商业化项目的全生命周期,确保项目按时、按质、按预算交付;制定并执行详细的项目计划,跟踪进度,协调资源;与销售、市场、客户支持团队协作,制定商业化策略,推动产品在不同市场的成功推广
全栈架构优化:负责文本基座(MoE/Dense)训练与推理管线的深度定制,集成并优化 Megatron、vLLM、SGLang 等核心框架;精度性能双调:通过 CUDA/Triton 算子开发与量化压缩,解决长文本通信与计算瓶颈,在压榨硬件极限的同时确保算法精度
洞察与定义:基于技术趋势与用户研究,定义AI硬件产品的核心功能与体验;规划与设计:撰写产品需求,规划产品路线图,精准定义硬件规格与性能指标;协同与落地:驱动算法、硬件、结构团队紧密协作,解决端侧部署与量产挑战
高质量交付:独立负责中型项目或大型项目中的复杂模块开发,确保功能按时、稳定上线;问题解决:能够快速定位和解决开发中、测试阶段及线上的各类前端技术问题,如性能瓶颈、兼容性难题、交互逻辑缺陷等
建设革命性的AI产品,在端侧设备上规划与落地AI能力,负责产品设计和数据分析;与业务团队协作,理解需求并完成技术评估、方案设计及交付推进;与研发团队合作提升AI效果,推动端侧推理等能力落地
负责审核与公司主营业务相关的中、英文业务合同,处理业务部门咨询;负责针对人工智能、数据等合规问题提供法律意见及解决方案;对公司内部流程和制度提出合理化建议,主导或协同推进涉及法务的业务流程优化
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,能够对领域最新技术进行及时吸纳和改进,通过技术创新和工程实践,支撑模型能力提升
负责AI Agent产品的用户增长与活跃,重点覆盖高校的大学生、研究生群体,对拉新、留存、活跃结果负责;负责智能体广场、知识库广场等平台产品的共创体系,包括激励机制设计与长期运营;建立并维护核心运营指标,定期进行数据统计、分析与复盘,推动运营方案落地
将公网环境下的AI Agent服务、工作流引擎及插件系统迁移至信创国产化内网环境;针对内网离线环境,重写或改造后端服务中依赖公网API、镜像仓库或第三方云服务的逻辑;优化后端架构,确保Agent在国产CPU(如飞腾、鲲鹏)和国产操作系统(如麒麟、统信)上的高可用性
统筹前后端、算法工程团队的研发管理工作,包括需求拆解、排期规划、任务分配与进度把控;建立敏捷开发机制,提升团队交付效率;衔接产研团队,保障业务目标与技术落地协同推进;主导AI教育平台技术架构优化与重构,重点保障系统高并发场景稳定性
协助团队负责人搭建团队工作数据台账,跟踪项目进度与成员工作状态,定期输出团队效能分析报告;统筹团队内外部会议,负责会议筹备、议程梳理、纪要撰写与决议事项跟进;协调跨部门、校企合作方的沟通对接,保障工作流程顺畅
负责预训练基础设施的整体架构设计与技术规划,主导Infra方案的落地实施;搭建并优化大规模预训练系统,确保千/万卡级别集群的高效稳定运行;主导分布式训练框架的选型、优化与二次开发,持续提升训练效率与资源利用率
负责强化学习训练平台的整体架构设计与技术规划,主导Infra方案的落地实施;搭建并优化RLHF/RL训练基础设施,确保强化学习训练的高效稳定进行;主导强化学习框架的选型、优化与定制开发,持续提升训练效率和模型性能
负责GPU算力平台的日常运维、监控告警与故障排查,保障平台稳定运行;开发和维护运维自动化工具,提升运维效率,降低人工干预成本;参与算力平台的容量规划、性能调优与资源调度优化;搭建和完善监控体系、日志系统与故障诊断平台
负责大模型量化算法的研究和实现,包括PTQ(训练后量化)和QAT(量化感知训练)等方向;探索低比特量化(INT2/INT4/MxFP4等)在大语言模型和多模态模型上的应用,平衡精度与效率
负责大模型预训练加速算法的研究与优化,涵盖MoE、多模态、创新架构等方向;针对MoE架构进行专项优化,包括Expert并行、负载均衡、通信优化等核心问题;研究并优化多模态模型(Vision-Language、Audio-Language等)的训练效率
负责大模型在垂直领域的应用及研发,包括空间理解、思维博弈场景;基于应用场景设计实现数据合成、模型微调和模型评估等解决方案;基于Agent/Multi-Agent、RAG等技术构建代码框架,推动模型落地应用
负责文本和多模态大模型的研发与应用,涵盖 SFT、RL、Agent/Multi;Agent、RAG 等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
负责文本和多模态大模型的研发与应用,涵盖 SFT、RL、Agent/Multi;Agent、RAG 等方向,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
参与长文本模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
参与长文本模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
参与长文本模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
参与MoE模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配;开展模型架构优化相关研发,提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
参与MoE模型的研发、部署、微调,主要涉及功能实现、性能优化、系统调优、硬件适配等工作;开展模型架构优化相关研发,从而提升模型训练与推理效率;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究
根据特定场景(如数学代码、长文本、科学领域等)筛选有效预训练数据并进行数据合成;根据需求进行模型对齐训练(包括SFT与RLHF)并验证模型效果;实现数据质量评估并建立完善的数据质量评估体系
根据特定场景(如数学代码、长文本、科学领域等)筛选有效预训练数据并进行数据合成;根据需求进行模型对齐训练(包括SFT与RLHF)并验证模型效果;实现数据质量评估并建立完善的数据质量评估体系
根据特定场景(如数学代码、长文本、科学领域等)筛选有效预训练数据并进行数据合成;根据需求进行模型对齐训练(包括SFT与RLHF)并验证模型效果;实现准确的数据质量评估并建立完善的数据质量评估体系
算法研究与开发;深入研究强化学习领域的前沿算法(PPO、GRPO等)并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;大规模应用强化学习,以提升模型长思考能力、通用能力、Agent能力等
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、入库、清洗、观测及挖掘;建立多模态数据的闭环验证体系,覆盖数据构造、模型训练到性能评测全链路;参与训练数据全生命周期管理体系建设,提升海量数据读取效率及模型训练工程效率
进行算法研究与开发;深入研究强化学习领域的前沿算法(如PPO、GRPO等)并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;大规模应用强化学习,以提升模型的长思考能力、通用能力、Agent能力等
算法研究与开发;深入研究强化学习领域的前沿算法(如PPO、GRPO等)并应用于大模型领域;优化强化学习训练框架,提升训练速度与稳定性;大规模应用强化学习,以提升模型的长思考能力、通用能力、Agent能力等
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、入库、清洗、观测及挖掘;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系,确保数据提升模型基础能力
负责多模态大模型预训练、指令微调、偏好对齐等阶段的数据建设工作,包括数据采集、入库、清洗、观测、挖掘等环节;负责多模态数据的闭环验证,建立从数据构造到模型训练再到性能评测的全链路闭环体系
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,及时吸纳和改进领域最新技术,通过技术创新和工程实践提升模型能力
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,能够对领域最新技术进行及时吸纳和改进,通过技术创新和工程实践,支撑模型能力提升
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
负责大规模分布式训练和推理的基础架构设计、开发、优化,支持千卡以上级别大规模模型训练;针对多模态数据特点,通过多样化的分布式并行策略和通信优化技术,支持长序列训练,有效解决多模态场景下的训练效率瓶颈,追求业界最领先的性能
研发基于大模型(LLM)的内容安全检测算法,包括有害信息识别、敏感话题过滤、虚假信息检测等;设计多模态(文本、图像、视频)内容安全检测方案,提升模型对不良内容的识别能力;探索大模型安全对齐(Alignment)技术,包括SFT、RLHF等多阶段优化模型生成内容的安全性
没有找到符合条件的岗位。