AI平台大数据架构师
岗位摘要
负责AI平台大数据架构演进以及推进落地:根据不同领域场景大模型落地需求,与算法团队和IT基础设施团队紧密合作,提出大模型训练和优化数据规模、数据类型、数据结构等建议,确保架构有效实施
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责AI平台大数据架构演进以及推进落地:根据不同领域场景大模型落地需求,与算法团队和IT基础设施团队紧密合作,提出大模型训练和优化数据规模、数据类型、数据结构等建议,确保架构有效实施
- 负责搭建大模型数据平台:支撑大模型数据的存储、预处理(去重、相似度计算、脱敏等)诉求,针对大模型场景、数据类型、数据规模具有高扩展性,以支持大模型数据集持续迭代,实现高质量数据集沉淀,确保数据安全和隐私保护
- 与算法团队紧密协作,抽象研发诉求,落地为便捷实用的的平台能力,提升整个团队的工作效率和数据处理能力
任职要求
- 计算机/人工智能及相关专业硕士及以上学历,优异者条件可适当放宽
- 具备3年以上数据处理或模型训练工作经验,熟练掌握文本、多模态等非结构化数据处理方法,精通数据清洗、特征提取和数据增强等技术,能够解决数据工作中各种问题
- 精通Python、Java等至少一种编程语言,熟悉常用的数据处理、文本处理和图像处理库,能够高效地实现数据清洗和处理的算法和流程
- 具备丰富的数据湖开发经验(Hudi、Iceberg、Hive等),并且对数据计算相关技术框架有深入的实践和理解(Spark、Flink、Hadoop、Ray)
- 具备优秀的分析问题和解决问题能力,勇于挑战和解决复杂问题
- 具备良好的团队协作和沟通能力,能够有效协调组内外资源以推动项目进展
- 主导过大模型或离在线场景下的数据平台建设,有海量图片、视频数据平台建设或大数据开源框架开发经验者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。