端侧LLM/VLM算法研究员
岗位摘要
负责多模态大模型(视觉语言模型VL/Omni)的研发与优化,重点面向端侧设备(移动端);设计与实现下一代端侧友好的模型结构,针对特定芯片进行算法与系统的协同设计;研究并落地低比特量化技术(w4a8、w2a16、fp8),协助完成异构硬件(如NPU)的模型部署
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责多模态大模型(视觉语言模型VL/Omni)的研发与优化,重点面向端侧设备(移动端)
- 设计与实现下一代端侧友好的模型结构,针对特定芯片进行算法与系统的协同设计
- 研究并落地低比特量化技术(w4a8、w2a16、fp8),协助完成异构硬件(如NPU)的模型部署
- 支持下游多模态智能体、端云智能体协同、场景对话、实时感知等业务需求
- 探索视觉语言模型在端上实时场景中的新应用
任职要求
- 熟悉主流大语言模型、视觉语言模型、扩散模型的原理与实现,深度学习基础扎实
- 熟悉大语言模型和视觉语言模型的预训练与后训练,熟悉模型压缩与加速技术(QAT、PTQ、fp8、蒸馏等)
- 熟悉主流训练、推理、部署框架:Megatron、Deepspeed、vLLM、llama.cpp、TNN/MNN等,有实际项目经验
- 加分项:熟悉使用Cuda、Triton等工具进行细粒度性能优化
- 加分项:系统性掌握前沿的大语言模型/视觉语言模型的算法与训练方法论,包括Scaling Law、MoE、Linear/hybrid Attention、MTP等
加分项
- 熟悉使用 Cuda、Triton 等工具进行细粒度性能优化
- 系统性掌握前沿的 LLM/VLM 的算法与训练方法论,包括 Scaling Law、MoE、Linear/hybrid Attention、MTP 等
- 刘若云 刚刚活跃
福利待遇
- 薪资50-80K·16薪
工作地址
北京海淀区大恒科技大厦9
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。