Software Engineer Accelerators San Francisco
岗位摘要
在新型加速器平台上原型化和启用OpenAI的AI软件堆栈;针对多样化硬件环境优化大规模模型性能(如LLMs、推荐系统、分布式AI工作负载);开发针对新兴加速器定制的内核、分片机制和系统扩展策略
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 在新型加速器平台上原型化和启用OpenAI的AI软件堆栈
- 针对多样化硬件环境优化大规模模型性能(如LLMs、推荐系统、分布式AI工作负载)
- 开发针对新兴加速器定制的内核、分片机制和系统扩展策略
- 在模型代码层面(如PyTorch)及以下进行优化,以提升非传统硬件上的性能
- 进行系统级性能建模,调试瓶颈并推动端到端优化
- 与硬件团队和供应商合作,评估现有平台的替代方案,并使软件堆栈适应其架构
- 为前沿AI工作负载的运行时改进、计算/通信重叠和扩展工作做出贡献
任职要求
- 3年以上AI基础设施工作经验,包括内核、系统或硬件-软件协同设计
- 具备数据中心规模AI加速器平台(如TPUs、定制硅片、探索性架构)的实际经验
- 深入了解内核、分片、运行时系统或分布式扩展技术
- 熟悉为硬件效率优化LLMs、CNNs或推荐模型
- 有性能建模、系统调试和为新型架构调整软件堆栈的经验
- 接触过移动加速器者优先,但更倾向于有数据中心规模AI硬件启用经验
- 能够在堆栈的多个层面操作,快速原型化解决方案,并在早期硬件启用阶段应对不确定性
- 对通过探索主流加速器替代方案来塑造AI计算的未来感兴趣
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。