技术团队成员(模型服务)
岗位摘要
开发、部署和运营AI平台,通过易于使用的API端点交付Cohere的大型语言模型;与多个团队紧密合作,在低延迟、高吞吐量、高可用性的生产环境中部署优化的NLP模型;与客户对接,创建满足其特定需求的定制化部署方案
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 开发、部署和运营AI平台,通过易于使用的API端点交付Cohere的大型语言模型
- 与多个团队紧密合作,在低延迟、高吞吐量、高可用性的生产环境中部署优化的NLP模型
- 与客户对接,创建满足其特定需求的定制化部署方案
任职要求
- 拥有5年以上大规模生产基础设施的工程经验
- 具备使用Kubernetes设计大型、高可用分布式系统的经验,以及在这些集群上运行GPU工作负载的经验
- 拥有Kubernetes开发、生产编码和支持经验
- 具备GCP、Azure、AWS、OCI、多云/本地/混合部署服务的经验
- 拥有在复杂的基于Linux的计算环境中设计、部署、支持和故障排除的经验
- 具备计算/存储/网络资源及成本管理经验
- 拥有出色的协作和故障排除技能,以构建关键任务系统,并确保运营顺畅和团队高效合作
- 具备解决日常复杂技术挑战的毅力和适应能力
- 熟悉加速器(GPU、TPU和/或定制加速器)的计算特性,尤其是它们如何影响推理的延迟和吞吐量
- 对分布式系统有深刻理解或实际工作经验
- 拥有Golang、C++或其他为高性能可扩展服务器设计的语言的经验
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。