多模态大语言模型研究员
岗位摘要
探索多模态预训练中更高效的数据与建模方法,确保算力提升时仍能延续Scaling Law;利用全球多模态数据,探索并实现更优的数据发现、清洗和生成策略;深入参与设计科学的MLLM实验,构建经济有效的MLLM训练数据方案
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 探索多模态预训练中更高效的数据与建模方法,确保算力提升时仍能延续Scaling Law
- 利用全球多模态数据,探索并实现更优的数据发现、清洗和生成策略
- 深入参与设计科学的MLLM实验,构建经济有效的MLLM训练数据方案
- 探索数据配比、模型扩展等相关前沿技术
- 深入参与并了解如何成功训练一个MLLM基座模型
任职要求
- 本科及以上学历,计算机、人工智能、自动化、数学专业优先
- 具备强大的工程能力,能快速迁移过往工程经验,深入理解系统底层原理并进行优化,学习能力强
- 对大模型的底层原理有基本理解,并能跟踪语言模型和多模态领域的最新技术动向
- 扎实的编程基础,深入理解数据结构与算法设计,熟练掌握Python/C++等至少一种主流语言,熟练应用PyTorch、TensorFlow、HuggingFace等深度学习框架
- 有ACM/IOI/NOI/Top Coder等算法竞赛获奖经历者优先
- 深入理解CV、NLP等机器学习领域知识,拥有MLLM预训练、后训练、对齐或数据筛选与优化相关实操经验者优先
- 熟悉Spark、Ray等分布式计算框架者优先
- 在顶级学术会议发表论文或在机器学习、人工智能领域取得优异成绩者优先
- 责任心强,积极主动,具备良好的沟通和合作能力
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。