【发布时间】:2017-10-30 17:55:37
【问题描述】:
我正在尝试将一些 Redshift 查询结果加载到 S3。到目前为止,我正在使用 pandas_redshift 但我被卡住了:
import pandas_redshift as pr
pr.connect_to_redshift( dbname = 'dbname',
host = 'xxx.us-east- 1.redshift.amazonaws.com',
port = 5439,
user = 'xxx',
password = 'xxx')
pr.connect_to_s3(aws_access_key_id = 'xxx',
aws_secret_access_key = 'xxx',
bucket = 'dxxx',
subdirectory = 'dir')
这是我要转储到 S3 的数据:
sql_statement = '''
select
provider,
provider_code
from db1.table1
group by provider, provider_code;
'''
df = pr.redshift_to_pandas(sql_statement)
df创建成功了,下一步怎么做,就是把这个dataframe放到S3上?
【问题讨论】:
标签: python pandas amazon-s3 amazon-redshift