返回岗位列表

MiniMax

高性能网络研发工程师

地点:北京 薪资:30-60K 日期:2026-03-03

岗位摘要

负责公司在AI训练、推理、数据传输等核心场景下的高性能网络系统设计与研发;参与RDMA、RoCEv2、DPDK等高性能网络技术的落地与优化,构建极致低延迟、高带宽的通信能力;设计并实现用户态网络协议栈、零拷贝通信、网络IO加速组件,提升多节点分布式系统通信效率

岗位职责

  • 负责公司在AI训练、推理、数据传输等核心场景下的高性能网络系统设计与研发
  • 参与RDMA、RoCEv2、DPDK等高性能网络技术的落地与优化,构建极致低延迟、高带宽的通信能力
  • 设计并实现用户态网络协议栈、零拷贝通信、网络IO加速组件,提升多节点分布式系统通信效率
  • 跟踪主流硬件(如SmartNIC、Mellanox/NVIDIA网卡、PCIe互联、NVLink)的能力,对接底层驱动进行优化调优
  • 推进高性能网络与平台系统(如训练框架、Kubernetes、RPC框架)之间的深度融合
  • 支持网络协议分析、性能调优、故障排查等系统级问题解决,提升系统整体稳定性与可观测性
  • 编写技术设计文档和标准化规范,参与团队技术沉淀和知识分享

任职要求

  • 本科及以上学历,计算机、电子工程、通信等相关专业,3年及以上系统或网络研发经验
  • 扎实的网络协议基础,精通TCP/IP、UDP、Socket编程,了解RDMA、RoCE、DPDK、XDP、eBPF、VPP等中至少一种
  • 熟悉Linux网络子系统,能够进行网络协议栈相关调优、profiling和调试分析
  • 熟练掌握C/C++/Rust/Go中的一种或多种,具备良好的系统设计与性能优化能力
  • 对高性能分布式计算或大规模AI系统有理解,熟悉分布式训练、AllReduce等通信模式优先
  • 具备良好的文档能力、沟通协作能力和工程交付意识
  • 有RDMA + NCCL + 分布式训练优化实战经验者优先
  • 有自研用户态协议栈或NIC Offload功能经验者优先
  • 有参与或维护TensorRT、Horovod、UCX、Libfabric、gRPC、DPDK、OFED等开源项目经验者优先
  • 熟悉SmartNIC编程(如P4、eBPF)、PCIe流控、多队列调度等底层原理者优先
  • 熟悉Kubernetes网络架构、Service Mesh或网络可观测性工具建设者优先
  • 有在超大规模集群中推进网络性能提升/压测/治理的经验者优先

加分项

  • 有 RDMA + NCCL + 分布式训练优化实战经验
  • 有自研用户态协议栈或 NIC Offload 功能经验
  • 有参与或维护 TensorRT、Horovod、UCX、Libfabric、gRPC、DPDK、OFED 等开源项目经验
  • 熟悉 SmartNIC 编程(如 P4、eBPF)、PCIe 流控、多队列调度等底层原理
  • 熟悉 Kubernetes 网络架构、Service Mesh 或网络可观测性工具建设
  • 有在超大规模集群中推进网络性能提升/压测/治理的经验
  • 陈笑涵 2月内活跃

工作地址

北京海淀区蓟门壹号8层