高性能计算工程师/专家(ChatGLM底层研究)
岗位摘要
参与ChatGLM大模型的推理优化工作,包括云端推理加速和端侧推理加速;负责模型量化与稀疏化技术研发,提升推理效率;进行GPU算子开发,实现异构计算优化;持续优化大模型推理性能,降低计算成本
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与ChatGLM大模型的推理优化工作,包括云端推理加速和端侧推理加速
- 负责模型量化与稀疏化技术研发,提升推理效率
- 进行GPU算子开发,实现异构计算优化
- 持续优化大模型推理性能,降低计算成本
任职要求
- 统招硕士及以上学历,计算机类专业,具有较强的工程能力和创新能力
- 了解计算机体系结构相关知识
- 了解大模型的结构与原理
- 有算子开发和模型量化经验者优先
工作地址
北京海淀区搜狐网络大厦11层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。