推理工程师
岗位摘要
构建和维护为全球数百万用户提供Claude模型服务的核心系统;负责从智能请求路由到跨多样化AI加速器的全栈编排;最大化计算效率以服务爆炸式增长的客户需求;为科学家提供高性能推理基础设施,以支持下一代模型的突破性研究
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 构建和维护为全球数百万用户提供Claude模型服务的核心系统
- 负责从智能请求路由到跨多样化AI加速器的全栈编排
- 最大化计算效率以服务爆炸式增长的客户需求
- 为科学家提供高性能推理基础设施,以支持下一代模型的突破性研究
- 解决跨多个加速器家族和新兴AI硬件的复杂分布式系统挑战
- 设计智能路由算法,优化跨数千个加速器的请求分发
- 自动扩展计算集群,动态匹配生产、研究和实验工作负载的供需
- 构建生产级部署管道,向数百万用户发布新模型
- 集成新的AI加速器平台,保持硬件无关的竞争优势
- 支持新模型架构的推理
- 分析可观测性数据,根据实际生产工作负载调整性能
- 管理多区域部署和面向全球客户的地理路由
任职要求
- 拥有丰富的软件工程经验,特别是分布式系统方面
- 结果导向,倾向于灵活性和影响力
- 愿意承担额外责任,即使超出职位描述范围
- 希望了解更多关于机器学习系统和基础设施的知识
- 在技术卓越直接推动业务成果和研究突破的环境中茁壮成长
- 关心工作的社会影响
- 具备高性能、大规模分布式系统经验者优先
- 具备大规模机器学习系统实施和部署经验者优先
- 具备负载均衡、请求路由或流量管理系统经验者优先
- 具备LLM推理优化、批处理和缓存策略经验者优先
- 具备Kubernetes和云基础设施(AWS, GCP)经验者优先
- 熟悉Python或Rust者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。