研究推理团队负责人
岗位摘要
设计和构建大规模AI模型的高性能推理运行时,注重效率、可靠性和可扩展性;拥有并优化核心执行路径,包括模型执行、内存管理、批处理和调度;开发和改进跨多GPU的分布式推理,包括并行策略、通信模式和运行时协调
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计和构建大规模AI模型的高性能推理运行时,注重效率、可靠性和可扩展性
- 拥有并优化核心执行路径,包括模型执行、内存管理、批处理和调度
- 开发和改进跨多GPU的分布式推理,包括并行策略、通信模式和运行时协调
- 根据实际工作负载实现和优化推理关键算子和内核
- 与研究团队紧密合作,确保新模型架构在推理系统中得到准确高效的支持
- 通过性能分析、基准测试和底层调试诊断并解决性能瓶颈
- 为大规模AI系统的可观测性、正确性和可靠性做出贡献
任职要求
- 具有构建生产级推理系统的经验,而不仅仅是训练或运行模型
- 熟悉以GPU为中心的性能工程,包括内存行为以及延迟/吞吐量权衡
- 曾参与涉及批处理、调度或运行时协调的多GPU或分布式系统工作
- 能够端到端地推理推理管道,从请求处理到执行和输出流
- 能够理解研究想法并在实际系统和性能约束内实现它们
- 喜欢解决仅在规模化时才会出现的困难、模糊的系统问题
- 偏好动手技术所有权和执行,而非抽象设计工作
福利待遇
- 加入顶尖AI研究团队,推动通用人工智能发展
- 参与前沿模型研究与系统工程交叉领域工作
- 平等就业机会,不歧视任何受法律保护的特征
- 根据适用法律进行背景调查,考虑有逮捕或定罪记录的合格申请人
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。