多模态大语言模型算法(预训练方向)
岗位摘要
深入参与设计科学的Kimi VLM scaling实验,构建有效的训练数据recipe,探索数据配比与模型scaling相关前沿技术;深度参与Kimi VLM数据清洗和优化,使用科学方式进行VLM预训练和对齐的数据质量提升、筛选和配比,涵盖图片、视频、视觉常识、视觉推理和多语种多模态数据等
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 深入参与设计科学的Kimi VLM scaling实验,构建有效的训练数据recipe,探索数据配比与模型scaling相关前沿技术
- 深度参与Kimi VLM数据清洗和优化,使用科学方式进行VLM预训练和对齐的数据质量提升、筛选和配比,涵盖图片、视频、视觉常识、视觉推理和多语种多模态数据等
- 构建支撑PB级别数据量的基础平台和工具,具备优秀的工程实现能力和数据处理能力
任职要求
- 本科及以上学历,计算机、人工智能、自动化、数学专业优先
- 扎实的编程基础,对数据结构、算法设计有深度了解,熟练掌握Python/C++等主流语言一种或多种,熟练应用PyTorch、TensorFlow、HuggingFace等深度学习框架和库
- 有大模型预训练、对齐训练丰富实操经验,或大模型数据筛选和优化相关经验优先
- 熟悉Spark、Ray等分布式计算框架优先
- 有ACM/IOI/NOI/TopCoder等算法竞赛获奖经历优先
- 在顶级学术会议上发表论文者优先,在机器学习、人工智能领域内获得过优异成绩者优先
- 责任心强,积极主动,有良好的沟通和团队合作能力
福利待遇
- 有竞争力的薪酬:25-50K·16薪
- 丰富的算力和数据资源支持
- 扁平化的沟通和管理,良好的团队氛围
- 深入参与前沿技术研究的机会
工作地址
北京海淀区京东科技大厦13层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。