AI院--多模态团队--多模态生成算法研究员
岗位摘要
智谱多模态大模型团队是全球领先的多模态研究团队之一,专注于推动视觉生成模型和视觉语言模型的发展,团队拥有从多模态生成到理解的全栈自研技术体系,依托强大的计算资源和全链路研发能力,持续引领行业创新
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 智谱多模态大模型团队是全球领先的多模态研究团队之一,专注于推动视觉生成模型和视觉语言模型的发展,团队拥有从多模态生成到理解的全栈自研技术体系,依托强大的计算资源和全链路研发能力,持续引领行业创新
- 团队先后推出并开源了CogView、CogVideo等前沿生成模型,其中CogVideoX是首个商业级别的开源视频生成模型,github star 1w+,hugging face下载量数百万,并应用于线上业务智谱清影
- 负责图像/视频生成模型训练及数据优化
任职要求
- 高校计算机、电子、自动化等相关专业硕士或博士学位(优秀本科生亦可考虑)
- 深入理解常用多模态算法;具备多模态大模型和视频理解相关项目经验者优先
- 在CCF-A类会议发表过多模态相关论文者优先考虑
- 熟练运用Pytorch、transformers、megatron等主流框架
- 工作态度认真负责,具备良好的团队协作能力
- 在ACL,NeurIPS,ICLR,EMNLP,ICML等顶级会议或期刊上发表过论文者优先
- 熟悉并行训练框架,有多机多卡训练经验者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。