大模型推理框架开发工程师
岗位摘要
基于壁仞GPU软件栈开发大模型与多模态大模型推理服务框架;围绕并行策略、GPU通信、算子融合、量化压缩持续优化推理性能;降低模型推理延迟并提升线上服务吞吐;与团队协作推进框架迭代与线上部署
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 基于壁仞GPU软件栈开发大模型与多模态大模型推理服务框架
- 围绕并行策略、GPU通信、算子融合、量化压缩持续优化推理性能
- 降低模型推理延迟并提升线上服务吞吐
- 与团队协作推进框架迭代与线上部署
任职要求
- 硕士及以上学历,计算机、数学、软件工程、自动化、通信、微电子等相关专业
- 扎实的C/C++或Python编程能力
- 熟悉大模型推理技术栈,有vLLM、SGLang、LMDeploy、TensorRT-LLM等框架适配经验优先
- 具备CUDA编程经验者优先
- 热爱技术、追求卓越,学习能力强,逻辑思维好,自驱力强
福利待遇
- 15薪高绩效激励
- 杭州滨江核心地段办公环境
- 参与前沿大模型推理技术落地
- 与顶尖GPU团队共同成长
工作地址
杭州滨江区海威天地T328F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。