端侧LLM/VLM算法研究员
岗位摘要
负责多模态大模型(Vision-Language Model, VL/Omni)的研发与优化,重点面向端侧设备(移动端);设计与实现下一代端侧友好的模型结构,针对特定芯片进行算法与系统的协同设计
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责多模态大模型(Vision-Language Model, VL/Omni)的研发与优化,重点面向端侧设备(移动端)
- 设计与实现下一代端侧友好的模型结构,针对特定芯片进行算法与系统的协同设计
- 研究并落地低比特量化技术(w4a8、w2a16、fp8),协助完成异构硬件(如NPU)的模型部署
- 支持下游多模态Agent、端云Agent协同、场景对话、实时感知等业务需求
- 探索VLM在端上实时场景中的新应用
任职要求
- 熟悉主流LLM、VLM、Diffusion Model的原理与实现,深度学习基础扎实
- 熟悉LLM、VLM的预训练与后训练,熟悉模型压缩与加速技术(QAT、PTQ、fp8、蒸馏等)
- 熟悉主流训练、推理、部署框架:Megatron、Deepspeed、vLLM、llama.cpp、TNN/MNN等,有实际项目经验
- 加分项:熟悉使用Cuda、Triton等工具进行细粒度性能优化
- 加分项:系统性掌握前沿的LLM/VLM算法与训练方法论,包括Scaling Law、MoE、Linear/hybrid Attention、MTP等
加分项
- 熟悉使用 Cuda、Triton 等工具进行细粒度性能优化
- 系统性掌握前沿的 LLM/VLM 的算法与训练方法论,包括 Scaling Law、MoE、Linear/hybrid Attention、MTP 等
- 许先生 刚刚活跃
工作地址
北京海淀区大恒科技大厦南座F9层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。