大模型推理优化系统工程师
岗位摘要
参与分布式大模型推理框架的开发与优化,提升推理性能与吞吐量;针对不同场景的LLM请求特点,优化GPU计算流程,打造业内领先的高效LLM推理引擎;调研并引入前沿机器学习系统技术,推动系统架构的持续优化升级
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与分布式大模型推理框架的开发与优化,提升推理性能与吞吐量
- 针对不同场景的LLM请求特点,优化GPU计算流程,打造业内领先的高效LLM推理引擎
- 调研并引入前沿机器学习系统技术,推动系统架构的持续优化升级
- 与算法团队深度合作,探索算法-系统协同优化方案,提升整体推理效率
任职要求
- 预计毕业时间介于2025年9月至2026年8月的国内外计算机、电子、自动化、软件等相关专业的优秀本科生或研究生
- 具备操作系统、计算机体系结构等基础知识,对底层性能优化有浓厚兴趣
- 熟悉SGLang、vLLM、Megatron等框架,有开源项目贡献或相关经验者优先
- 熟悉CUDA编程和GPU上性能优化,有Triton、CUTLASS等开发经验者优先
- 具备良好的沟通能力和团队协作精神
福利待遇
- 提供有竞争力的薪酬,薪资范围30-35K
- 与顶尖算法团队深度合作,探索前沿技术
- 公司位于北京海淀区大恒科技大厦,交通便利
- 开放包容的技术氛围,适合应届生成长发展
工作地址
北京海淀区大恒科技大厦南座9层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。