端侧 LLM/VLM 算法研究员
岗位摘要
负责端侧多模态大模型(VLM/Omni)的研发与优化,设计端侧友好的模型架构,针对目标芯片进行算法-系统协同设计;研究并落地低比特量化(W4A8/W2A16/FP8)等压缩技术,协助完成 NPU 等异构硬件的模型部署
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责端侧多模态大模型(VLM/Omni)的研发与优化,设计端侧友好的模型架构,针对目标芯片进行算法-系统协同设计
- 研究并落地低比特量化(W4A8/W2A16/FP8)等压缩技术,协助完成 NPU 等异构硬件的模型部署
- 支持端侧多模态 Agent、端云协同、实时感知等场景落地,探索 VLM 在端上的新应用
任职要求
- 熟悉主流 LLM/VLM/Diffusion Model 原理与实现,深度学习基础扎实
- 熟悉模型预训练与后训练,掌握 QAT、PTQ、FP8、蒸馏等压缩加速技术
- 熟悉 Megatron、DeepSpeed、vLLM、llama.cpp、TNN/MNN 等训练推理部署框架,有实际项目经验
加分项
- 熟练使⽤ CUDA、Triton 进行细粒度性能优化
- 系统掌握 Scaling Law、MoE、Linear/Hybrid Attention、MTP 等前沿方法论
- 吴珣 刚刚活跃
福利待遇
- 薪资范围 100-200K·16薪
- 硕士学历要求,1-3年经验
- 工作地点位于北京海淀区大恒科技大厦
工作地址
北京海淀区大恒科技大厦00
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。