【发布时间】:2020-08-12 22:46:17
【问题描述】:
我有一个直接从 redshift 读取数据的胶水作业,为此,必须提供连接凭据。我已经创建了一个嵌入式粘合连接,并且可以使用以下 pyspark 代码提取凭据。有没有办法在 Scala 中做到这一点?
glue = boto3.client('glue', region_name='us-east-1')
response = glue.get_connection(
Name='name-of-embedded-connection',
HidePassword=False
)
table = spark.read.format(
'com.databricks.spark.redshift'
).option(
'url',
'jdbc:redshift://prod.us-east-1.redshift.amazonaws.com:5439/db'
).option(
'user',
response['Connection']['ConnectionProperties']['USERNAME']
).option(
'password',
response['Connection']['ConnectionProperties']['PASSWORD']
).option(
'dbtable',
'db.table'
).option(
'tempdir',
's3://config/glue/temp/redshift/'
).option(
'forward_spark_s3_credentials', 'true'
).load()
【问题讨论】:
标签: scala pyspark amazon-redshift aws-glue aws-java-sdk