【问题标题】:Read data from glue catalog in AWS Glue Job从 AWS Glue 作业中的粘合目录读取数据
【发布时间】:2021-05-07 13:53:50
【问题描述】:

我有连接到 Kafka 的胶水作业。数据保存在胶水数据目录中,在作业中我需要阅读它。我接下来尝试了:

df = glueContext.create_data_frame.from_catalog(database = "t-kafka-db", table_name = "t-kafka", transformation_ctx = "df", connectionType="kafka")
df = glueContext.create_dynamic_frame_from_catalog(database="t-kafka-db",table_name="t-kafka",transformation_ctx="df")
df = glueContext.create_dynamic_frame.from_catalog(database = "t-kafka-db",table_name = "t-kafka",transformation_ctx = "df",additional_options = {"startingOffsets": "earliest", "inferSchema": "false"})

它们都返回相同的错误:

An error occurred while calling o67.getCatalogSource. We don't support this connection type: KAFKA

帮忙解决

【问题讨论】:

    标签: apache-kafka aws-glue aws-glue-data-catalog


    【解决方案1】:

    AWS Glue 现在支持从 Kafka 读取。请参考this,其中讨论了为流式源创建数据目录表。

    【讨论】:

      猜你喜欢
      • 2022-07-08
      • 2018-11-09
      • 2021-06-16
      • 2021-08-27
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-09-14
      相关资源
      最近更新 更多