多模态大模型端侧研发工程师
岗位摘要
负责多模态大模型(Vision-Language Model, VL/Omni)的研发与优化,重点面向端侧设备(移动端);设计与实现下一代的端侧友好的模型结构,针对特定芯片进行算法与系统的协同设计
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责多模态大模型(Vision-Language Model, VL/Omni)的研发与优化,重点面向端侧设备(移动端)
- 设计与实现下一代的端侧友好的模型结构,针对特定芯片进行算法与系统的协同设计
- 研究并落地低比特量化技术(如w4a8、w2a16、fp8)
- 协助完成模型在异构硬件(如NPU)上的部署
- 支持下游多模态Agent、端云Agent协同、场景对话、实时感知等业务需求
- 探索VLM在端上实时场景中的新应用
任职要求
- 熟悉主流LLM、VLM、Diffusion Model的原理与实现,深度学习基础扎实
- 熟悉LLM、VLM的预训练与后训练,熟悉模型压缩与加速技术(如QAT、PTQ、fp8、蒸馏等)
- 熟悉主流训练、推理、部署框架(如Megatron、Deepspeed、vLLM、llama.cpp、TNN/MNN等),并具备实际项目经验
加分项
- 熟悉使用 Cuda、Triton 等工具进行细粒度性能优化
- 系统性掌握前沿的 LLM/VLM 的算法与训练方法论,包括 Scaling Law、MoE、Linear/hybrid Attention、MTP 等
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。