大模型端测部署工程师
岗位摘要
将大模型部署到多种端测环境,完成落地系统整合;在端侧环境中对推理性能进行调试与测试,重点提升推理时延、启动时延与资源效率;协调硬件与软件团队,推动端测部署的稳定性、容错、升级;计算机、软件、电子工程或相关专业本科及以上学历
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 将大模型部署到多种端测环境,完成落地系统整合
- 在端侧环境中对推理性能进行调试与测试,重点提升推理时延、启动时延与资源效率
- 协调硬件与软件团队,推动端测部署的稳定性、容错、升级
任职要求
- 计算机、软件、电子工程或相关专业本科及以上学历
- 有端测/嵌入式/车载推理经验者优先
- 精通C++/CUDA/硬件加速器编程,有能力在资源受限环境中做低层调优
- 熟悉常见推理优化方法:量化、混合精度、剪枝、蒸馏等
- 熟悉或有实际应用经验以下技术或指标:FlashAttention, FlashInfer/KV‑cache优化等
- 基于MFU/MBU(Model FLOPS Utilization/Model Bandwidth Utilization)做性能瓶颈分析与优化
- 熟练使用性能分析工具(如nvprof、nsys、perf、ebpf工具等)进行延时/带宽/内存瓶颈排查
- 有良好的代码质量意识、调试能力与跨团队协作能力
加分项
- 有视觉‑语言 / 多模态模型(VLA / VLM)在端测 /设备端的部署经验
- 有 NPU / GPU / AI 加速器(如车载 NPU、移动 GPU / NPUs)适配 / kernel 优化经验
- 有推理服务平台 / 端测自动化部署 / OTA 升级经验
福利待遇
- 有视觉‑语言/多模态模型(VLA/VLM)在端测/设备端的部署经验者优先
- 有NPU/GPU/AI加速器(如车载NPU、移动GPU/NPUs)适配/kernel优化经验者优先
- 有推理服务平台/端测自动化部署/OTA升级经验者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。