返回岗位列表

面壁智能

全栈架构优化工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

全栈架构优化:负责文本基座(MoE/Dense)训练与推理管线的深度定制,集成并优化 Megatron、vLLM、SGLang 等核心框架;精度性能双调:通过 CUDA/Triton 算子开发与量化压缩,解决长文本通信与计算瓶颈,在压榨硬件极限的同时确保算法精度

岗位职责

  • 全栈架构优化:负责文本基座(MoE/Dense)训练与推理管线的深度定制,集成并优化 Megatron、vLLM、SGLang 等核心框架
  • 精度性能双调:通过 CUDA/Triton 算子开发与量化压缩,解决长文本通信与计算瓶颈,在压榨硬件极限的同时确保算法精度

任职要求

  • 硬核编程功底:精通 C++/CUDA/Python,有深度改造分布式框架或内核级算子优化的实战经验
  • 算法与系统协同能力:深刻理解 LLM 架构原理,能从底层系统视角定位并解决训练稳定性、收敛精度等系统级算法问题
  • 一线实战经验:熟悉模型并行策略与强化学习(RL)工程链路,具备 GPU 集群性能瓶颈诊断与极致调优能力