返回岗位列表

月之暗面

视觉语言模型研究员

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

参与 Kimi-VL 等视觉语言模型的预训练和后训练,优化模型在长视频理解、长文档阅读等问题中的表现,提升模型的准确性和效率;对在大语言模型上学习视频进行研究和探索,结合 Kimi 产品的特点和优势,探索新的算法和架构,提高模型在视频场景下的泛化能力

岗位职责

  • 参与 Kimi-VL 等视觉语言模型的预训练和后训练,优化模型在长视频理解、长文档阅读等问题中的表现,提升模型的准确性和效率
  • 对在大语言模型上学习视频进行研究和探索,结合 Kimi 产品的特点和优势,探索新的算法和架构,提高模型在视频场景下的泛化能力
  • 负责数据的优化和质量提升工作,以满足模型训练和优化的需求;深入分析数据特点和模型输出结果,为模型改进提供依据
  • 设计并实施视频相关强化学习模型的评估指标和方法,对模型进行性能评估和分析;找出模型存在的问题和不足,提出切实可行的改进方案

任职要求

  • 计算机科学、人工智能、机器学习、数学等相关专业的研究生及以上学历
  • 熟练使用深度学习框架(如 PyTorch 或 TensorFlow),具有使用这些框架进行模型训练和开发的丰富经验
  • 了解视觉强化学习的基本概念和原理,对相关算法(如 PPO、A3C 等)和模型架构(如视觉编码器、Transformer 等)有一定的研究和实践经验
  • 有参与机器学习、深度学习或强化学习相关项目的经历,熟悉模型训练、优化和部署流程,具备独立完成项目任务的能力;有在视觉强化学习领域的项目经验者优先
  • 具备良好的文献阅读和理解能力,能够快速掌握最新的视觉强化学习研究动态和技术趋势;对发表过相关领域论文者优先
  • 具有良好的团队合作精神和沟通能力,能够与团队成员密切合作,共同推进项目的进展