视觉语言模型研究员
岗位摘要
参与 Kimi-VL 等视觉语言模型的预训练和后训练,优化模型在长视频理解、长文档阅读等问题中的表现,提升模型的准确性和效率;对在大语言模型上学习视频进行研究和探索,结合 Kimi 产品的特点和优势,探索新的算法和架构,提高模型在视频场景下的泛化能力
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与 Kimi-VL 等视觉语言模型的预训练和后训练,优化模型在长视频理解、长文档阅读等问题中的表现,提升模型的准确性和效率
- 对在大语言模型上学习视频进行研究和探索,结合 Kimi 产品的特点和优势,探索新的算法和架构,提高模型在视频场景下的泛化能力
- 负责数据的优化和质量提升工作,以满足模型训练和优化的需求;深入分析数据特点和模型输出结果,为模型改进提供依据
- 设计并实施视频相关强化学习模型的评估指标和方法,对模型进行性能评估和分析;找出模型存在的问题和不足,提出切实可行的改进方案
任职要求
- 计算机科学、人工智能、机器学习、数学等相关专业的研究生及以上学历
- 熟练使用深度学习框架(如 PyTorch 或 TensorFlow),具有使用这些框架进行模型训练和开发的丰富经验
- 了解视觉强化学习的基本概念和原理,对相关算法(如 PPO、A3C 等)和模型架构(如视觉编码器、Transformer 等)有一定的研究和实践经验
- 有参与机器学习、深度学习或强化学习相关项目的经历,熟悉模型训练、优化和部署流程,具备独立完成项目任务的能力;有在视觉强化学习领域的项目经验者优先
- 具备良好的文献阅读和理解能力,能够快速掌握最新的视觉强化学习研究动态和技术趋势;对发表过相关领域论文者优先
- 具有良好的团队合作精神和沟通能力,能够与团队成员密切合作,共同推进项目的进展
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。