大模型全栈研究员
岗位摘要
负责文本基座(MoE/Dense)训练与推理管线的深度定制;集成并优化Megatron、vLLM、SGLang等核心框架;通过CUDA/Triton算子开发与量化压缩,解决长文本通信与计算瓶颈
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责文本基座(MoE/Dense)训练与推理管线的深度定制
- 集成并优化Megatron、vLLM、SGLang等核心框架
- 通过CUDA/Triton算子开发与量化压缩,解决长文本通信与计算瓶颈
- 在压榨硬件极限的同时确保算法精度
任职要求
- 精通C++/CUDA/Python,有深度改造分布式框架或内核级算子优化的实战经验
- 深刻理解LLM架构原理,能从底层系统视角定位并解决训练稳定性、收敛精度等系统级算法问题
- 熟悉模型并行策略与强化学习(RL)工程链路
- 具备GPU集群性能瓶颈诊断与极致调优能力
- 硕士及以上学历,经验不限
福利待遇
- 月薪40-70K,15薪
- 工作地点位于北京海淀区科建大厦
工作地址
北京海淀区科建大厦4层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。