数据研发工程师
岗位摘要
负责大规模离线数据仓库的模型设计,包括ODS/DWD/DWS/ADS,保障数据一致性、完整性和可追溯性;深入业务场景,作为业务数据BP承接指标口径、数据分析、专题取数、报表建设和数据问题排查等需求,推动数据资产沉淀
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责大规模离线数据仓库的模型设计,包括ODS/DWD/DWS/ADS,保障数据一致性、完整性和可追溯性
- 深入业务场景,作为业务数据BP承接指标口径、数据分析、专题取数、报表建设和数据问题排查等需求,推动数据资产沉淀
- 优化Hive/Spark SQL任务,解决数据倾斜、资源竞争、任务延迟、产出不稳定等性能和稳定性问题
- 参与实时数据流处理链路设计,基于Flink/OLAP实现低延迟的数据清洗、聚合和实时指标计算
- 结合AI实践数据开发、数据分析、口径查询、任务排障等环节的提效
任职要求
- 具备至少1年数据BP开发经验,熟悉离线数仓建设方法论,精通阿里云dataworks体系或者大数据技术栈
- 熟悉实时计算框架,如Flink/Spark Streaming,并了解Kafka/RocketMQ等消息队列,对Hive/Spark离线任务调优有深入实践
- 有较强的数据质量意识,能够建立数据校验、异常监控、链路追踪和问题复盘机制
- 熟练使用AI,有agent实践,如规划、记忆、工具调用,或实际使用过Agent/AI工具辅助开发、分析、排障者优先
- 熟悉ClickHouse/Doris等OLAP引擎,有高性能查询、实时数仓或湖仓一体建设经验者优先
福利待遇
- 薪资范围:40-70K·15薪
- 工作地点:北京海淀区蓟门壹号8楼
- 非外包类岗位
工作地址
北京海淀区蓟门壹号8楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。