【发布时间】:2014-07-27 22:04:33
【问题描述】:
有没有办法直接从 Hadoop/HDFS(本地/本地集群)将数据加载到 Redshift 和 Bigquery。我需要将 1TB 的数据加载到 Redshift 和 Bigquery。所以寻找有效的方法来做到这一点。
谢谢
【问题讨论】:
标签: database amazon-web-services google-bigquery google-cloud-sql amazon-redshift
有没有办法直接从 Hadoop/HDFS(本地/本地集群)将数据加载到 Redshift 和 Bigquery。我需要将 1TB 的数据加载到 Redshift 和 Bigquery。所以寻找有效的方法来做到这一点。
谢谢
【问题讨论】:
标签: database amazon-web-services google-bigquery google-cloud-sql amazon-redshift
您还可以使用支持 Hadoop、Redshift、BigQuery、Google Cloud Storage 和 Amazon S3 的 ETL 工具。
Talend for Big Data 是一种支持所有这些不同数据源的 ETL 解决方案。
【讨论】:
您可以直接从 Amazon EMR 加载,但如果您使用的是 本地 Hadoop 集群,则必须将数据导出到 S3 并使用 COPY 命令从那里加载到 Redshift:
【讨论】: