返回岗位列表

智谱AI

可观测性高级/架构工程师

地点:北京 薪资:30-55K 日期:2026-09-18

岗位摘要

负责公司可观测性平台(Metrics/Logging/Tracing)的架构设计与核心能力建设,为业务提供一站式监控、告警、排障与根因分析能力;负责数据采集侧建设,包括基于Java Agent与字节码增强的无侵入探针、OpenTelemetry标准接入以及多语言SDK体系,持续降低业务接入成本

岗位职责

  • 负责公司可观测性平台(Metrics/Logging/Tracing)的架构设计与核心能力建设,为业务提供一站式监控、告警、排障与根因分析能力
  • 负责数据采集侧建设,包括基于Java Agent与字节码增强的无侵入探针、OpenTelemetry标准接入以及多语言SDK体系,持续降低业务接入成本
  • 负责遥测数据存储与计算架构演进,优化海量指标、日志、链路的写入、索引与查询,平衡查询体验与资源成本
  • 负责告警体系与故障定位能力建设,将可观测能力与故障治理流程(发现—定位—止损—复盘)深度结合,缩短MTTR
  • 制定可观测性接入标准与最佳实践,推动各业务团队规模化接入,建设平台化、自助化的可观测产品

任职要求

  • 本科及以上学历,3年以上开发经验,深入理解Java/JVM,熟悉多线程与字节码增强(ASM/ByteBuddy)及Java Agent原理;或具备Go/C++高性能组件开发经验
  • 熟悉Prometheus、Grafana、ELK/Loki、SkyWalking、OpenTelemetry等可观测性生态中多个组件的原理与源码,有APM、监控平台或链路追踪系统的实际建设经验
  • 理解指标、日志、链路三者的数据模型与关联方式,能从故障定位、根因分析等真实场景反推数据模型与产品能力设计,而非仅会搭建开源组件
  • 具备海量数据处理经验,了解时序数据库、列式存储、流式计算,以及采样、降精度等遥测数据成本治理手段
  • 具备较强的系统设计、性能优化和线上问题定位能力,能主导重大技术方案设计并处理线上复杂问题
  • 有平台产品意识和成本意识,具备较强的跨团队沟通与推动能力,能推动可观测能力在业务团队规模化落地
  • 具备良好的技术判断力,能平衡业务需求、系统复杂度和演进成本;保持技术深度和动手能力,能参与核心方案设计及关键代码评审
  • 加分项:熟悉eBPF、Continuous Profiling(持续剖析)、RUM等前沿可观测技术;熟悉OpenTelemetry规范并有相关社区贡献;有大规模型时序库(VictoriaMetrics/Thanos/M3DB等)或异构存储优化经验;有SRE体系建设或SLO落地经验

加分项

  • 熟悉 eBPF、Continuous Profiling(持续剖析)、RUM 等前沿可观测技术
  • 熟悉 OpenTelemetry 规范,有相关社区贡献
  • 有大规模时序库(VictoriaMetrics / Thanos / M3DB 等)或异构存储优化经验
  • 有 SRE 体系建设或 SLO 落地经验
  • 张先生 刚刚活跃

福利待遇

  • 薪资范围30-55K,全年16薪
  • 工作地点位于北京海淀区搜狐网络大厦

工作地址

北京海淀区搜狐网络大厦10