数据/基础设施倡导工程师 - 美国远程
岗位摘要
发展和培育开源数据/基础设施社区:发起倡议,与数据相关团体合作,组织活动或挑战;与Apache Parquet、开放表格式和数据工程论坛等社区互动,推广最佳实践和Hugging Face工具
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 发展和培育开源数据/基础设施社区:发起倡议,与数据相关团体合作,组织活动或挑战
- 与Apache Parquet、开放表格式和数据工程论坛等社区互动,推广最佳实践和Hugging Face工具
- 推广Hugging Face Hub作为数据存储、版本化和协作的首选平台,策划和展示数据集、基准测试和Xet等工具
- 突出高效大数据集更新、Parquet编辑和去重等用例,展示Hub在数据工作流中的价值
- 创建演示、基准测试和工具(如Colab笔记本),展示数据存储和版本化的最佳实践,并实验Xet、Parquet和其他格式
- 制作高质量教程、博客文章和视频,使复杂主题易于理解
- 分享关于存储优化、数据集版本化和去重的见解,赋能开发者
- 积极参与在线社区(Discord、GitHub、论坛),突出贡献、回答问题并促进协作
- 确保Hub上发布的数据集和工具文档完善,附带清晰的示例、基准测试和用例
任职要求
- 3年以上开发者关系或开发者倡导经验,理想情况下涉及数据工程、基础设施或ML工具和平台
- 作为技术声音拥有成熟的公众形象,有定期发布数据/基础设施/ML内容的记录,并在LinkedIn和X(Twitter)上拥有可证明的活跃受众
- 拥有面向开发者的内容作品集:教程、博客文章、视频、演示、基准测试或会议演讲
- 有构建和参与开源或开发者社区(Discord、GitHub、论坛)的实践经验
- 扎实的Python技能
- 有使用pandas、pyarrow和huggingface/datasets等数据库的实践经验
- 有存储系统和格式(Parquet、开放表格式和S3)的实践经验
- 具备数据集版本化、去重和压缩的工作知识
- 能够通过写作、演示或演讲清晰解释复杂技术主题
- 有Hugging Face Hub和数据集生态系统或Xet经验者优先
- 有开源维护者或贡献者经验者优先
- 熟悉大规模数据处理者优先
福利待遇
- 远程工作机会
- 参与前沿AI和开源项目
- 与全球顶尖AI社区互动
- 塑造开放数据工作流未来的机会
- 与Hugging Face核心团队协作
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。