大模型大数据开发工程师-多模态方向
岗位摘要
设计、开发和维护基于Spark/Ray的大规模自动化ETL Pipeline,处理PB级多模态图文数据;优化图文数据的准确性与丰富度,以提升多模态大模型的能力上限;计算机、大数据相关专业,本科及以上学历
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计、开发和维护基于Spark/Ray的大规模自动化ETL Pipeline,处理PB级多模态图文数据
- 优化图文数据的准确性与丰富度,以提升多模态大模型的能力上限
任职要求
- 计算机、大数据相关专业,本科及以上学历
- 具备扎实的代码能力,熟悉Python,熟悉多线程编程、分布式计算、网络通信、内存管理
- 熟悉Linux环境,能编写Shell/Python脚本自动化日常任务
- 熟练掌握Spark、Hive、Hadoop等大数据处理工具/框架,有VLM数据管理/处理基建开发与设计经验
- 了解深度学习基础原理,以及多模态大模型基础原理
- 有丰富的多模态数据处理/挖掘经验者优先
- 有大规模数据处理基建Pipeline的设计开发经验者优先
- 有深度学习CV/NLP、多模态大模型训练经验者优先
加分项
- 有丰富的多模态数据处理/挖掘经验者 优先 有大规模数据处理基建Pipeline 的 设计开发经验者 优先 有深度学习CV/NLP、多模态大模型训练经验者 优先
- 陈女士 刚刚活跃
工作地址
北京海淀区阶跃星辰公司
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。