多模态AI研究员
岗位摘要
深入研究并探索视觉语言模型(VLM)、多模态大语言模型(MLLM)等对齐技术;跟踪多模态AI领域的最新技术动态,优化和改进现有技术和系统;研究多模态模型的对齐中存在的问题;探索多模态对齐数据构建、清洗和优化方案
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 深入研究并探索视觉语言模型(VLM)、多模态大语言模型(MLLM)等对齐技术
- 跟踪多模态AI领域的最新技术动态,优化和改进现有技术和系统
- 研究多模态模型的对齐中存在的问题
- 探索多模态对齐数据构建、清洗和优化方案
任职要求
- 熟悉Python, Linux, PyTorch等深度学习必备知识,精通深度学习、机器学习、计算机视觉、自然语言处理的基本知识
- 有在ICLR、ICCV、CVPR、ECCV、NeurIPS、ICML、TPAMI、ACL、EMNLP等国际顶级会议和期刊上发表成果的优先
- 熟悉预训练算法的历史,熟悉对比学习,MAE等大语言模型之前的预训练算法,有Visual-Language Model和大规模语言模型(LLMs)方面的经验者优先
- 熟悉Flamingo, Llava, Fuyu等多模态大模型的基本原理与优劣,熟悉MMMU, MathVista等多模态评测方式
- 具备优秀的团队合作意识和沟通能力,出色的自我驱动和抗压能力,强烈的求知欲和技术热情,优秀的数据分析和逻辑思维能力
- 对多模态模型如何提升当前语言模型能力有独到的见解
加分项
- 在高影响力项目中做出过核心贡献者优先考虑
福利待遇
- 在高影响力项目中做出过核心贡献者优先考虑
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。