多模态大模型算法优化工程师
岗位摘要
主动跟踪学术界与工业界在图像视频生成式模型、多模态理解模型、语音模型及多模态统一建模等方向的创新算法研究;攻克Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)及多模态理解生成统一建模加速等技术方向
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 主动跟踪学术界与工业界在图像视频生成式模型、多模态理解模型、语音模型及多模态统一建模等方向的创新算法研究
- 攻克Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)及多模态理解生成统一建模加速等技术方向
- 应用包括Attention量化/稀疏加速、蒸馏加速、量化、投机解码、剪枝、KV Cache压缩等在内的多种技术
- 通过分析模型和任务性能瓶颈,设计创新的算法优化方案,提升多模态大模型的推理效率,显著降低端到端延迟
- 作为算法与框架团队之间的技术桥梁,聚焦于图像理解、视频生成、音频理解生成、视觉多轮交互、实时对话等任务,提升模型在推理端的性能
- 高效协同框架开发及业务算法团队,确保技术方案落地
- 撰写高质量的技术文档与实验报告,并组织内部分享,推动团队整体技术认知提升
任职要求
- 具备跟踪学术界与工业界前沿算法研究的能力
- 熟悉图像、视频、语音等多模态生成与理解模型的相关技术
- 掌握Diffusion模型加速、多模态理解模型、语音模型(ASR、TTS、Omini等)及多模态统一建模加速中的一项或多项技术
- 精通或了解多种模型优化与加速技术,如Attention量化/稀疏加速、蒸馏加速、量化、投机解码、剪枝、KV Cache压缩等
- 具备分析模型性能瓶颈并设计创新优化方案的能力
- 能够作为算法与框架团队之间的技术桥梁进行有效沟通与协作
- 具备良好的团队协作能力,能与框架开发及业务算法团队高效协同
- 具备优秀的技术文档与实验报告撰写能力,并能组织内部分享
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。