返回岗位列表

小米

大模型端测部署工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

将大模型部署到多种端测环境,完成落地系统整合;在端侧环境中对推理性能进行调试与测试,重点提升推理时延、启动时延与资源效率;协调硬件与软件团队,推动端测部署的稳定性、容错、升级;计算机、软件、电子工程或相关专业本科及以上学历

岗位职责

  • 将大模型部署到多种端测环境,完成落地系统整合
  • 在端侧环境中对推理性能进行调试与测试,重点提升推理时延、启动时延与资源效率
  • 协调硬件与软件团队,推动端测部署的稳定性、容错、升级

任职要求

  • 计算机、软件、电子工程或相关专业本科及以上学历
  • 有端测/嵌入式/车载推理经验者优先
  • 精通C++/CUDA/硬件加速器编程,有能力在资源受限环境中做低层调优
  • 熟悉常见推理优化方法:量化、混合精度、剪枝、蒸馏等
  • 熟悉或有实际应用经验以下技术或指标:FlashAttention, FlashInfer/KV‑cache优化等
  • 基于MFU/MBU(Model FLOPS Utilization/Model Bandwidth Utilization)做性能瓶颈分析与优化
  • 熟练使用性能分析工具(如nvprof、nsys、perf、ebpf工具等)进行延时/带宽/内存瓶颈排查
  • 有良好的代码质量意识、调试能力与跨团队协作能力

加分项

  • 有视觉‑语言 / 多模态模型(VLA / VLM)在端测 /设备端的部署经验
  • 有 NPU / GPU / AI 加速器(如车载 NPU、移动 GPU / NPUs)适配 / kernel 优化经验
  • 有推理服务平台 / 端测自动化部署 / OTA 升级经验

福利待遇

  • 有视觉‑语言/多模态模型(VLA/VLM)在端测/设备端的部署经验者优先
  • 有NPU/GPU/AI加速器(如车载NPU、移动GPU/NPUs)适配/kernel优化经验者优先
  • 有推理服务平台/端测自动化部署/OTA升级经验者优先