【问题标题】:Consuming DynamoDB Streams with AWS Kinesis Data Analytics使用 AWS Kinesis Data Analytics 使用 DynamoDB 流
【发布时间】:2020-12-14 05:19:28
【问题描述】:

我正在使用 Kinesis Firehose 通过 lambda 使用 Dyanamo DB 流并将这些记录推送到 S3 存储桶,Glue 作业每小时运行一次以从 S3 中挑选记录,执行重复数据删除,然后最后将记录插入 Redshift。

有什么方法可以使用 Dynamo Streams 中的记录到“Kinesis Data Analytics”,然后在此处执行重复数据删除并将记录插入 Redshift?

我已经浏览了一些链接https://issues.apache.org/jira/browse/FLINK-4582Consume DynamoDB streams in Apache Flink

  • 这里提到我们可以使用 FlinkKinesisConsumer 来 使用 DynamoDB 流

。 那么我们可以在 Kinesis Data Analytics 中使用这个 FlinkKinesisConsumer,然后直接使用 Dynamo Stream 吗?

【问题讨论】:

  • 我不确定我的理解是否正确,您想在 Kinesis Data Analytics 中而不是在 AWS Glue 中进行重复数据删除?我认为这里可以回答:stackoverflow.com/questions/35599069/…
  • @B.Pesevski,我正在寻找 Firehose 和 Glue 是否都可以替换为“Kinesis Data Analytics”

标签: amazon-web-services amazon-redshift amazon-kinesis amazon-dynamodb-streams amazon-kinesis-analytics


【解决方案1】:

使用 Flink 作为 Kinesis Data Analytics 的运行时。

来源https://docs.aws.amazon.com/kinesisanalytics/latest/java/how-sources.html

'FlinkKinesisConsumer' 可用于适配 Dynamo DB Streams (https://issues.apache.org/jira/browse/FLINK-4582)。

目的地: https://docs.aws.amazon.com/kinesisanalytics/latest/java/how-sinks.html

“FlinkKinesisFirehoseProducer”可用于写入“Kinesis data firehose”。没有与 Redshift 的直接集成。

【讨论】:

    猜你喜欢
    • 2017-02-24
    • 1970-01-01
    • 1970-01-01
    • 2018-11-20
    • 1970-01-01
    • 2019-10-04
    • 2020-05-18
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多