返回岗位列表

面壁智能

企业级AI基础设施架构师

地点:北京 薪资:薪资未公开 日期:2026-07-20

岗位摘要

负责企业级Agentic Infra私有化部署架构设计,覆盖Kubernetes、GPU/NPU资源、模型Serving、对象存储、消息队列、日志监控、权限与网络安全等关键组件;面向运营商、金融民生等客户复杂IT环境,完成部署方案、资源评估、容量规划、网络拓扑、数据安全、容灾与运维方案设计

岗位职责

  • 负责企业级Agentic Infra私有化部署架构设计,覆盖Kubernetes、GPU/NPU资源、模型Serving、对象存储、消息队列、日志监控、权限与网络安全等关键组件
  • 面向运营商、金融民生等客户复杂IT环境,完成部署方案、资源评估、容量规划、网络拓扑、数据安全、容灾与运维方案设计
  • 负责大模型推理服务、Agent Runtime、RAG服务、Workflow编排、工具调用、权限网关、审计日志等能力的工程集成
  • 针对客户私有化环境中的性能、稳定性、成本和兼容性问题,进行系统级优化,包括推理吞吐、延迟、显存利用、缓存策略、并发控制和服务降级
  • 建设标准化部署包、环境检查工具、自动化验收脚本等,提升项目交付效率
  • 与FDE、解决方案、产品团队协同,将灯塔项目中的部署经验沉淀为可复制的Agentic Infra行业交付基线

任职要求

  • 本科及以上学历,计算机、软件工程、人工智能等相关专业
  • 3年以上后端、平台架构、云原生、AI Infra、模型Serving或企业级私有化交付经验
  • 熟悉至少一种大模型推理或Serving框架,如vLLM、SGLang、TensorRT、ONNX等
  • 理解RAG、Agent Runtime、Tool Use、Workflow编排、权限与审计等大模型应用基础设施
  • 具备复杂线上问题排查能力,能从网络、资源、服务、模型、数据、并发和客户环境多维度定位问题
  • 加分项:有运营商、金融、政企、央国企等客户私有化交付经验
  • 加分项:有GPU集群、国产化算力、昇腾/昆仑/寒武纪等平台适配经验
  • 加分项:有LLMOps平台、智能体平台、RAG平台或模型网关建设经验
  • 加分项:有信创、数据不出域、内外网隔离、权限审计等合规场景经验

加分项

  • 有运营商、金融、政企、央国企等客户私有化交付经验
  • 有 GPU 集群、国产化算力、昇腾 / 昆仑 / 寒武纪等平台适配经验
  • 有 LLMOps 平台、智能体平台、RAG 平台或模型网关建设经验
  • 有信创、数据不出域、内外网隔离、权限审计等合规场景经验

福利待遇

  • 具有竞争力的薪酬和绩效奖金
  • 五险一金及补充商业保险
  • 弹性工作时间和远程办公机会
  • 丰富的职业发展培训和晋升通道
  • 参与前沿AI基础设施项目的机会