高级网络工程师 - 超级计算团队
岗位摘要
构建和优化流量平台,自动化并简化跨数十个本地和云集群的生产推理引擎生命周期管理,处理负载均衡、路由、过载控制、身份验证/授权、传输加密等核心流量原语;使用Envoy、NGINX等L4/L7代理管理、扩展和优化xAI的生产推理能力
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 构建和优化流量平台,自动化并简化跨数十个本地和云集群的生产推理引擎生命周期管理,处理负载均衡、路由、过载控制、身份验证/授权、传输加密等核心流量原语
- 使用Envoy、NGINX等L4/L7代理管理、扩展和优化xAI的生产推理能力
- 管理和扩展xAI的服务发现系统,包括Kubernetes内外的系统(DNS、xDS控制平面)
- 与网络结构工程师合作,改善大规模训练运行(如Grok 4及更高版本)的主机网络和结构稳定性
- 与快速、精干的技术团队合作,执行xAI关键路径上的项目
任职要求
- 2年以上Kubernetes集群运维经验,或编写和部署控制器的经验
- 2年以上配置和部署Envoy、NGINX、HAProxy或其他L7软件负载均衡器的经验
- 1年以上DNS系统(如CoreDNS、Unbound)或服务发现控制平面(xDS)经验
- 1年以上云网络原语经验(VPC路由表、云NAT、对等/传输网关、CDN、Cloudflare Workers或等效技术)
- 具备主机级网络代理(iptables、nftables、IPVS、eBPF程序)经验者优先
- 具备服务网格(Istio、Linkerd)经验者优先
- 具备Kubernetes和Envoy内部工作原理的实践经验——能够解释k8s缓存客户端的工作原理以及Envoy如何扩展和管理状态
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。