资深SRE运维工程师
岗位摘要
负责MaaS平台业务的高可用架构设计与落地,保障全链路系统正常运行,通过异地多活、多层容灾架构、服务降级与限流等技术手段持续提升业务稳定性;负责跨境及复杂网络环境下的架构设计与运维保障,包括多地域/多云网络互联、跨境专线与加速链路的规划管理、网络质量监控与调优
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责MaaS平台业务的高可用架构设计与落地,保障全链路系统正常运行,通过异地多活、多层容灾架构、服务降级与限流等技术手段持续提升业务稳定性
- 负责跨境及复杂网络环境下的架构设计与运维保障,包括多地域/多云网络互联、跨境专线与加速链路的规划管理、网络质量监控与调优
- 建设并完善全链路监控与可观测性体系(指标、日志、链路追踪),提升系统可见性,推动故障的快速发现、精准定位与高效恢复
- 结合软件与系统工程理念,设计并落地基于Kubernetes的自动化运维与交付平台(CI/CD、基础设施即代码),支撑大规模集群与服务的快速、稳定迭代
- 参与OnCall值班,第一时间响应并处理各类线上突发事件,主导复杂业务问题的根因排查(特别是跨地域网络或链路性能瓶颈分析),并落地长期修复与预防方案
任职要求
- 全日制统招本科及以上学历,计算机或相关专业,具备3年以上SRE、基础架构或大规模分布式系统运维经验
- 深入理解Linux操作系统原理,熟悉底层网络协议栈(TCP/IP、HTTP/HTTPS、DNS等)、存储、网络I/O及内核调优
- 具备丰富的跨境网络、混合云网络或多中心数据网络的运维经验,有全球流量调度、跨国专线优化、CDN质量调优经验者优先
- 对分布式系统的高可用治理有深刻理解,在大型复杂系统(如电商、社交、搜索推荐等)中负责过稳定性保障,熟悉微服务架构下的限流、熔断、降级、容灾等服务治理手段
- 熟练掌握至少一种编程语言(Go/Python/Java)以及Shell脚本,具备系统化的工程开发能力,而非纯手工运维
- 深入理解Kubernetes核心原理与生态,拥有主流公有云(阿里云、腾讯云等)的使用与运维经验
福利待遇
- 具备竞争力的薪酬:25-50K·16薪
- 参与全球范围内大规模复杂系统的稳定性建设,积累前沿技术经验
- 专业的技术团队与良好的技术氛围
工作地址
北京海淀区搜狐网络大厦10层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。