G
goodreads_etl_pipeline
san089/goodreads_etl_pipeline
用于构建数据湖、数据仓库和分析平台的端到端GoodReads数据管道
★1.5kstars
Python
MIT
更新: 1天前
📋 项目速览
点击展开
这是什么?用Python构建、打造开源数据与基础设施项目,专注airflow和airflow-dag方向
作者是谁?由 san089 团队维护,GitHub 1.5K⭐,在 数据与基础设施 分类 3133 个项目中排名第 864
为什么诞生?数据与基础设施领域快速发展,airflow场景缺乏高效方案,goodreads_etl_pipeline应运而生,专注于简化airflow-dag相关工作流程。
能干什么?核心场景:apache-airflow、apache-spark、data-engineering
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/san089/goodreads_etl_pipeline
🔗 github.com/san089/goodreads_etl_pipeline
标签
airflowairflow-dagapache-airflowapache-sparkdata-engineeringdata-engineering-pipelinedata-lakedata-migrationemr-clusteretl-frameworketl-jobetl-pipelinegoodreads-data-pipelinelivypythonredshifts3schedulersparkwarehouse