大模型推理优化工程师
岗位摘要
参与分布式大模型推理框架的开发与优化,提升推理性能与吞吐量;针对不同场景的LLM请求特点,优化GPU计算流程,打造业内领先的高效LLM推理引擎;调研并引入前沿机器学习系统技术,推动系统架构的持续优化升级
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与分布式大模型推理框架的开发与优化,提升推理性能与吞吐量
- 针对不同场景的LLM请求特点,优化GPU计算流程,打造业内领先的高效LLM推理引擎
- 调研并引入前沿机器学习系统技术,推动系统架构的持续优化升级
- 与算法团队深度合作,探索算法-系统协同优化方案,提升整体推理效率
任职要求
- 在校学生:计算机、软件工程、人工智能、电子工程、数学等相关专业在读
- 每周可到岗4天及以上,实习时长不少于3个月(6个月以上优先)
- 熟练掌握C++或Python中至少一门,具备扎实的计算机基础(操作系统、计算机体系结构、数据结构与算法)
- 理解Transformer计算图,了解LLM推理Prefill/Decode两阶段特性
- 使用过vLLM、SGLang、TensorRT-LLM中至少一个推理框架
加分项
- (满足任一即可,非硬性
福利待遇
- 日薪400-500元
- 参与前沿大模型推理技术研发
- 与资深工程师和算法团队合作
- 积累分布式系统和GPU优化实战经验
工作地址
北京海淀区理想国际大厦11层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。