Software Engineer Inference Multi Modal San Francisco
岗位摘要
设计和实现大规模多模态模型的推理基础设施;优化系统以实现图像和音频输入输出的高吞吐量、低延迟交付;将实验性研究工作流程转变为可靠的生产服务;与研究团队、基础设施团队和产品工程师紧密合作,部署最先进的功能
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计和实现大规模多模态模型的推理基础设施
- 优化系统以实现图像和音频输入输出的高吞吐量、低延迟交付
- 将实验性研究工作流程转变为可靠的生产服务
- 与研究团队、基础设施团队和产品工程师紧密合作,部署最先进的功能
- 参与系统级改进,包括GPU利用率、张量并行和硬件抽象层
任职要求
- 有构建和扩展LLM或多模态模型推理系统的经验
- 熟悉基于GPU的机器学习工作负载,了解大型模型的性能动态,尤其是处理图像或音频等复杂数据时
- 喜欢实验性、快速变化的工作,并愿意与研究团队紧密合作
- 能够处理涉及网络、分布式计算和高吞吐量数据处理的系统
- 熟悉推理工具,如vLLM、TensorRT-LLM或自定义模型并行系统
- 能够端到端解决问题,并乐于在模糊、快速变化的环境中工作
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。