AGI数据研发工程师
岗位摘要
负责大模型应用上下游业务(用户增长、商业化、留存、效果评估)的数据仓库与集市建设,确保数据可复用性与可用性;参与大模型基础数据流的架构设计与开发工作,覆盖训练数据、评测数据、样本生成、特征清洗、奖励模型等关键流程的数据链路建设
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责大模型应用上下游业务(用户增长、商业化、留存、效果评估)的数据仓库与集市建设,确保数据可复用性与可用性
- 参与大模型基础数据流的架构设计与开发工作,覆盖训练数据、评测数据、样本生成、特征清洗、奖励模型等关键流程的数据链路建设
- 使用AI技术优化大数据建管用全链路流程,包含数据集成与分发、离线实时数仓建设、数据分析与挖掘、数据治理与资产管控
任职要求
- 熟练使用SQL、Python编程语言
- 对Spark/Flink/Kafka/ClickHouse等大数据技术中的至少一个有过深入研究
- 熟悉数据仓库理论方法及ETL相关技术,对于数据的架构和设计有一定的思考,具备良好的建模思维
- 具备强烈的主动推进及问题解决思维,有良好的团队合作意识
- 具备广告、商业化、用户增长、投放业务背景者优先
- 具备大模型数据链路(清洗、分类、打分、去重、样本生成、CC数据集处理等)业务背景者优先
加分项
- 具备广告、商业化、用户增长、投放业务背景
- 具备大模型数据链路(清洗、分类、打分、去重、样本生成、cc数据集处理等)业务背景
- 曹先生 本月活跃
- MiniMax · 数据负责人
工作地址
北京海淀区蓟门壹号8
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。