返回岗位列表

腾讯

多模态大模型算法优化工程师

地点:深圳 薪资:薪资未公开 日期:2026-01-29

岗位摘要

主动跟踪学术界与工业界在图像视频生成式模型、多模态理解模型、语音模型及多模态统一建模等方向的创新算法研究;攻克Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)及多模态理解生成统一建模加速等技术方向

岗位职责

  • 主动跟踪学术界与工业界在图像视频生成式模型、多模态理解模型、语音模型及多模态统一建模等方向的创新算法研究
  • 攻克Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)及多模态理解生成统一建模加速等技术方向
  • 应用包括Attention量化/稀疏加速、蒸馏加速、量化、投机解码、剪枝、KV Cache压缩等在内的多种技术
  • 通过分析模型和任务性能瓶颈,设计创新的算法优化方案,提升多模态大模型的推理效率,显著降低端到端延迟
  • 作为算法与框架团队之间的技术桥梁,聚焦于图像理解、视频生成、音频理解生成、视觉多轮交互、实时对话等任务,提升模型在推理端的性能
  • 高效协同框架开发及业务算法团队,确保技术方案落地
  • 撰写高质量的技术文档与实验报告,并组织内部分享,推动团队整体技术认知提升

任职要求

  • 具备跟踪学术界与工业界前沿算法研究的能力
  • 熟悉图像、视频、语音等多模态生成与理解模型的相关技术
  • 掌握Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)及多模态统一建模加速中的一项或多项技术
  • 精通或了解多种模型优化与加速技术,如Attention量化/稀疏加速、蒸馏加速、量化、投机解码、剪枝、KV Cache压缩等
  • 具备分析模型性能瓶颈并设计创新优化方案的能力
  • 能够作为算法与框架团队之间的技术桥梁进行有效沟通与协作
  • 具备良好的团队协作能力,能与框架开发及业务算法团队高效协同
  • 具备优秀的技术文档与实验报告撰写能力,并能组织内部分享