多模态数据工程师
岗位摘要
负责构建超大规模高质量多模态数据集,建立从原始视频抓取、清洗、质量评估到自动化标注的全链路工业化流水线;实施支持多模态参考与视频编辑的专项数据工程,通过自动化手段生产图生视频、视频指令编辑、动作/风格参考等任务所需的高度对齐配对数据
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责构建超大规模高质量多模态数据集,建立从原始视频抓取、清洗、质量评估到自动化标注的全链路工业化流水线
- 实施支持多模态参考与视频编辑的专项数据工程,通过自动化手段生产图生视频、视频指令编辑、动作/风格参考等任务所需的高度对齐配对数据
- 研发高性能视频数据处理工具链,利用多模态大模型实现视频内容的精准描述、美学打磨及结构化解析,确保持续产出高质量训练样本
- 建立数据质量监控与闭环体系,通过量化指标驱动数据集的迭代更新,支撑通用视频生成模型在真实工业场景下的效果落地
任职要求
- 具备深厚的多模态理解与大规模数据工程经验,熟练掌握视频/图像清洗、去重、美学评估及自动化标注技术
- 精通多模态大模型(LMMs/VLM)的部署与应用,能够利用视觉语言模型实现视频内容的密集标注(Dense Captioning)与属性提取
- 扎实的编程功底与大规模数据处理能力,熟练使用 PyTorch 框架,具备处理海量非结构化数据及维护高性能分布式数据流水线的实战经验
- 极强的工业化落地能力,目标导向,善于将复杂的业务需求拆解为可执行的数据方案,并具备快速迭代和交付的能力
- 熟悉视频生成相关技术架构(如 Diffusion Transformers, VAE, Video Tokenizer),能够根据模型反馈精准调整数据生产策略者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。