GPU工程师
岗位摘要
负责OpenAI推理栈在AMD硬件上的启动、正确性和性能优化;将内部模型服务基础设施(如vLLM、Triton)集成到多种GPU支持的系统;调试和优化分布式推理工作负载,涵盖内存、网络和计算层
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责OpenAI推理栈在AMD硬件上的启动、正确性和性能优化
- 将内部模型服务基础设施(如vLLM、Triton)集成到多种GPU支持的系统
- 调试和优化分布式推理工作负载,涵盖内存、网络和计算层
- 验证大型GPU集群上模型执行的正确性、性能和可扩展性
- 与合作伙伴团队协作,使用HIP、Triton或其他高性能框架设计和优化高性能GPU内核
- 与合作伙伴团队协作,构建、集成和调优用于在多GPU上并行化模型执行的集体通信库(如RCCL)
任职要求
- 有使用HIP、CUDA或Triton编写或移植GPU内核的经验,并高度关注底层性能
- 熟悉NCCL/RCCL等通信库,并了解其在高吞吐量模型服务中的作用
- 有分布式推理系统工作经验,能够轻松将模型扩展到多台加速器上
- 喜欢解决硬件、系统库和编排层的端到端性能挑战
- 热衷于成为一个小型、快速移动的团队的一员,从基本原理构建新基础设施
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。