返回岗位列表

面壁智能

大模型全栈研究员

地点:北京 薪资:40-70K 日期:2026-03-03

岗位摘要

负责文本基座(MoE/Dense)训练与推理管线的深度定制与全栈架构优化;集成并优化Megatron、vLLM、SGLang等核心分布式框架;通过CUDA/Triton算子开发与量化压缩技术解决长文本通信与计算瓶颈

岗位职责

  • 负责文本基座(MoE/Dense)训练与推理管线的深度定制与全栈架构优化
  • 集成并优化Megatron、vLLM、SGLang等核心分布式框架
  • 通过CUDA/Triton算子开发与量化压缩技术解决长文本通信与计算瓶颈
  • 在压榨硬件极限的同时确保算法精度达标

任职要求

  • 精通C++/CUDA/Python编程,具备深度改造分布式框架或内核级算子优化的实战经验
  • 深刻理解LLM架构原理,能从底层系统视角定位并解决训练稳定性、收敛精度等系统级算法问题
  • 熟悉模型并行策略与强化学习(RL)工程链路
  • 具备GPU集群性能瓶颈诊断与极致调优能力

工作地址

北京海淀区科建大厦北京市海淀区科建大厦