DataHub 关键词情报 · 数据更新至 2026-07-22
壁仞科技算法与研究招聘
本页聚焦壁仞科技算法与研究相关岗位,便于用户比较岗位职责、地点、薪资标注和详情入口。
活跃公司
- 壁仞科技20 · 100.0%
热门地点
- 上海13 · 65.0%
- 杭州6 · 30.0%
- 深圳1 · 5.0%
岗位方向
- 算法与研究20 · 100.0%
OPEN ROLES
代表岗位
强化学习算法工程师
参与强化学习框架在国产芯片的适配开发及优化;参与强化学习及其框架开源社区的推动和发展;参与基于国产芯片的强化学习相关项目的落地和交付;跟踪前沿论文与开源方案,推动新方法在业务场景落地;扎实的机器学习/深度学习基础,理解策略梯度、Actor-Critic、价值函数等核心概念
大模型训练框架适配工程师
负责主流大模型训练框架在壁仞芯片平台上的适配、功能验证、问题排查与性能调优;支撑预训练、微调等核心训练链路建设,落地MoE、多模态、智能驾驶等业务场景;定位并解决精度、显存、通信、算子等训练问题,搭建自动化工程体系
AI Native 研究工程师
围绕AI赋能芯片软硬件研发,开展前沿技术探索、原型开发和工程验证;研究算法、硬件架构和软件栈之间的协同优化方法,推动软硬件协同设计;利用大模型、代码Agent、自动化工具链提升研发效率,包括代码生成、验证辅助、设计空间探索、文档生成、实验分析等
大模型推理框架开发工程师
基于壁仞GPU软件栈,开发大模型和多模态大模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩等方面,持续优化大语言模型推理性能,降低模型推理延迟,提升线上模型服务吞吐;硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业,三年及以上相关工作经历
大模型推理优化工程师
基于壁仞GPU软件栈,开发大模型和多模态大模型推理服务框架;进行模型部署优化;围绕并行策略、GPU通信、算子融合、量化压缩等方面,持续优化大语言模型推理性能;降低模型推理延迟,提升线上模型服务吞吐
大模型训练引擎工程师
负责主流大模型训练框架在壁仞芯片平台上的适配、功能验证、问题排查与性能调优;支撑预训练、微调等核心训练链路建设,落地MoE、多模态、智能驾驶等业务场景;定位并解决精度、显存、通信、算子等训练问题,搭建自动化工程体系
大模型推理框架开发工程师
基于壁仞GPU软件栈,开发大模型和多模态大模型推理服务框架;围绕并行策略优化GPU通信效率,提升模型推理整体性能;通过算子融合与量化压缩技术,降低大语言模型推理延迟;持续优化线上模型服务吞吐,保障高并发场景下的稳定性
大模型推理框架开发工程师
基于壁仞GPU软件栈,开发大模型和多模态模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩等方面持续优化大语言模型推理性能;降低模型推理延迟,提升线上模型服务吞吐;硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业,三年及以上相关工作经历
大模型系统优化工程师(国产AI芯片方向)
基于Megatron-LM完成大模型在国产AI芯片的端到端适配,移植并调优DP/TP/PP/EP等多维并行策略;针对国产芯片硬件特性优化GEMM、Attention、MoE、AllReduce等关键算子,提升训练吞吐与MFU
大模型推理框架开发工程师
基于壁仞GPU软件栈,开发并维护大模型及多模态大模型推理服务框架;设计并实现并行策略、GPU通信、算子融合、量化压缩等核心优化方案;持续降低模型推理延迟,提升线上服务吞吐量与稳定性;与硬件、算法、产品团队协同,推动框架在业务场景快速落地
大模型推理框架开发工程师
基于壁仞GPU软件栈开发大模型及多模态大模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩持续优化推理性能;降低模型推理延迟,提升线上服务吞吐量;硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业,3年以上相关经验
大模型推理框架开发工程师
基于壁仞GPU软件栈,开发大模型及多模态大模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩等方向持续优化大语言模型推理性能;降低模型推理延迟,提升线上模型服务吞吐;硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业,3年及以上相关经验
大模型推理框架开发工程师
基于壁仞GPU软件栈开发大模型与多模态大模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩持续优化推理性能;降低模型推理延迟并提升线上服务吞吐;与团队协作推进框架迭代与线上部署
大模型推理框架开发工程师
基于壁仞GPU软件栈,开发并维护大模型与多模态大模型推理服务框架;设计并实现并行策略、GPU通信、算子融合、量化压缩等核心优化方案;持续降低大语言模型推理延迟,提升线上服务吞吐与稳定性
大模型推理优化与GPU算子开发工程师
负责大模型推理引擎核心研发与性能优化,降低延迟并提升吞吐量;对主流大模型进行算子级深度优化,实现高性能GPU内核;基于CUDA/C++开发定制化算子,结合自研GPU硬件特性调优;研发PD分离、Continuous Batching、PagedAttention等前沿推理调度机制
AI模型性能分析实习生
对大模型、自驾模型、多模态模型、语音模型、视频生成模型、世界模型、具身智能模型等各类AI模型进行算子级别的workload分析;评估模型在推理和训练场景下的整体性能瓶颈;解析模型在推理和训练场景下的算法原理
大模型推理服务框架开发工程师
基于壁仞GPU软件栈,开发大模型和多模态大模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩等方面,持续优化大语言模型推理性能;降低模型推理延迟,提升线上模型服务吞吐;硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业
大模型推理服务框架开发工程师
基于壁仞GPU生态,实现大模型推理服务框架,进行特性覆盖和持续升级,包括vllm、SGLang等主流方向;基于壁仞GPU生态,通过量化、算子融合、通信优化、并行策略、投机采样、PD分离等多种技术手段,持续提升大模型性能
AI模型性能优化工程师
AI模型的算子开发与优化;AI模型推理或训练场景的端到端性能调优;与软硬件架构师协作,进行软件流程及架构探索;驱动并解决跨团队的性能问题;计算机、电子信息或相关专业本科及以上学历;具备CUDA、OpenCL等高性能并行编程能力
大模型推理服务框架开发工程师
基于壁仞GPU生态,实现大模型推理服务框架;进行框架特性覆盖和持续升级,包括vllm、SGLang等主流方向;硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业;三年以上相关工作经历
相关搜索词
这些词用于覆盖真实搜索需求,也方便用户继续定位公司、城市、岗位方向和薪资信息。