高性能网络专家
岗位摘要
负责公司在 AI 训练、推理、数据传输等核心场景下的高性能网络系统设计与研发;参与 RDMA、RoCEv2、DPDK 等高性能网络技术的落地与优化,构建极致低延迟、高带宽的通信能力;设计并实现用户态网络协议栈、零拷贝通信、网络 IO 加速组件,提升多节点分布式系统通信效率
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责公司在 AI 训练、推理、数据传输等核心场景下的高性能网络系统设计与研发
- 参与 RDMA、RoCEv2、DPDK 等高性能网络技术的落地与优化,构建极致低延迟、高带宽的通信能力
- 设计并实现用户态网络协议栈、零拷贝通信、网络 IO 加速组件,提升多节点分布式系统通信效率
- 跟踪主流硬件(如 SmartNIC、Mellanox/NVIDIA 网卡、PCIe 互联、NVLink)的能力,对接底层驱动进行优化调优
- 推进高性能网络与平台系统(如训练框架、Kubernetes、RPC 框架)之间的深度融合
- 支持网络协议分析、性能调优、故障排查等系统级问题解决,提升系统整体稳定性与可观测性
- 编写技术设计文档和标准化规范,参与团队技术沉淀和知识分享
任职要求
- 本科及以上学历,计算机、电子工程、通信等相关专业,3 年及以上系统或网络研发经验
- 扎实的网络协议基础,精通 TCP/IP、UDP、Socket 编程,了解 RDMA、RoCE、DPDK、XDP、eBPF、VPP 等中至少一种
- 熟悉 Linux 网络子系统,能够进行网络协议栈相关调优、profiling 和调试分析
- 熟练掌握 C/C++/Rust/Go 中的一种或多种,具备良好的系统设计与性能优化能力
- 对高性能分布式计算或大规模 AI 系统有理解,熟悉分布式训练、AllReduce 等通信模式优先
- 具备良好的文档能力、沟通协作能力和工程交付意识
- 有 RDMA + NCCL + 分布式训练优化实战经验
- 有自研用户态协议栈或 NIC Offload 功能经验
- 有参与或维护 TensorRT、Horovod、UCX、Libfabric、gRPC、DPDK、OFED 等开源项目经验
- 熟悉 SmartNIC 编程(如 P4、eBPF)、PCIe 流控、多队列调度等底层原理
加分项
- 有 RDMA + NCCL + 分布式训练优化实战经验
- 有自研用户态协议栈或 NIC Offload 功能经验
- 有参与或维护 TensorRT、Horovod、UCX、Libfabric、gRPC、DPDK、OFED 等开源项目经验
- 熟悉 SmartNIC 编程(如 P4、eBPF)、PCIe 流控、多队列调度等底层原理
- 熟悉 Kubernetes 网络架构、Service Mesh 或网络可观测性工具建设
- 有在超大规模集群中推进网络性能提升/压测/治理的经验
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。