AI数据开发工程师
岗位摘要
参与模型训练数据集的构建,包括数据清洗与处理,实现数据闭环,构建稳定高性能的分布式pipeline;负责模型训练数据标签体系的构建,搭建自动化打标能力,打通线上用户数据并分析数据分布
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与模型训练数据集的构建,包括数据清洗与处理,实现数据闭环,构建稳定高性能的分布式pipeline
- 负责模型训练数据标签体系的构建,搭建自动化打标能力,打通线上用户数据并分析数据分布
- 参与AI数据平台的开发,实现数据可视化、元数据管理、数据集管理与数据检索等功能
- 参与打通模型数据的全生命周期,实现自动化数据流转,辅助提升训练、评估等环节的数据使用效率
任职要求
- 统招本科及以上学历,计算机或相关专业,三年及以上多模态算法、大数据或数据平台开发经验
- 精通Python语言,熟悉Ray或Spark等分布式框架,具备大规模数据处理的实践经验
- 对前沿AI技术保持好奇心和学习欲望,能够提出有价值的技术改进方案
- 有多模态算法、数据闭环、算法工程化、非结构化数据治理或数据中台实践经验者优先
福利待遇
- 具有竞争力的薪酬福利,薪资范围40-70K,16薪
- 加入智谱华章核心团队,与多模态数据及工程负责人闫胜东直接协作
- 参与前沿AI技术研发,接触多模态数据、Ray等先进技术与平台
- 良好的职业发展空间和技术成长环境
工作地址
北京海淀区搜狐网络大厦11层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。