返回岗位列表

昆仑万维

AI视频-多模态理解算法工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

负责 AI视频 业务中的多模态内容理解的研究与开发,包括但不限于:图文/视频等的分类和标签、多模态信息检索以及内容质量识别等相关工作;负责跟踪和探索多模态大模型前沿问题,参与多模态大模型的设计、训练、调优及评测工作,并推进多模态大模型在业务场景的应用落地

岗位职责

  • 负责 AI视频 业务中的多模态内容理解的研究与开发,包括但不限于:图文/视频等的分类和标签、多模态信息检索以及内容质量识别等相关工作
  • 负责跟踪和探索多模态大模型前沿问题,参与多模态大模型的设计、训练、调优及评测工作,并推进多模态大模型在业务场景的应用落地

任职要求

  • 计算机科学、机器学习、人工智能、应用数学等相关专业硕士及以上学历
  • 在计算机视觉、多模态理解等方面具有扎实的研究基础,熟悉CLIP、ALBEF、BEIT3、BLIP、LLAVA等主流多模态理解与生成算法
  • 具有多模态大模型的研究与开发经验
  • 具有极强的好奇心、自驱力以及算法与模型创新能力
  • 在CVPR、AAAI、NIPS、TIP、ICCV、ECCV等顶级会议或期刊发表过高水平论文者优先
  • 精通至少一种编程语言,包括但不限于Python、C/C++等