返回岗位列表

阶跃星辰

大模型数据开发工程师

地点:北京 薪资:35-65K 日期:2026-06-26

岗位摘要

设计、开发和维护基于Spark/Ray的大规模自动化ETL Pipeline,处理PB级多模态图文数据;优化图文数据的准确性和丰富度,以提升多模态模型的能力上限;计算机、大数据相关专业,本科及以上学历

岗位职责

  • 设计、开发和维护基于Spark/Ray的大规模自动化ETL Pipeline,处理PB级多模态图文数据
  • 优化图文数据的准确性和丰富度,以提升多模态模型的能力上限

任职要求

  • 计算机、大数据相关专业,本科及以上学历
  • 具备扎实的代码能力,熟悉Python,熟悉多线程编程、分布式计算、网络通信、内存管理
  • 熟悉Linux环境,能编写Shell/Python脚本自动化日常任务
  • 熟练掌握Spark、Hive、Hadoop等大数据处理工具/框架,有VLM数据管理/处理基建开发与设计经验
  • 了解深度学习基础原理,以及多模态大模型基础原理

加分项

  • 有丰富的多模态数据处理/挖掘经验者 优先
  • 有大规模数据处理基建Pipeline 的 设计开发经验者 优先
  • 有深度学习CV/NLP、多模态大模型训练经验者 优先

福利待遇

  • 薪资范围35-65K·16薪
  • 非外包类岗位
  • 工作地点在北京海淀区

工作地址

北京海淀区大恒科技大厦-南座中关村大恒科技大厦南座12F