【问题标题】:Apache Ignite to Amazon S3 connectivityApache Ignite 到 Amazon S3 的连接
【发布时间】:2017-09-29 08:27:03
【问题描述】:

我想知道如何将数据从 Amazon S3 加载到 Apache Ignite 集群?需要单节点还是多节点集群?

【问题讨论】:

标签: ignite


【解决方案1】:

您可以将数据加载到任何集群、单节点或多节点,只要您的数据集适合该集群的内存即可。有关数据加载的信息,请参阅此文档页面:https://apacheignite.readme.io/docs/data-loading

【讨论】:

    【解决方案2】:

    您可以使用 Spark + Ignite 作为解决方法,使用 spark 读取 S3,然后写入 ignite,如 Ignite 示例中所述。

    另外,您可以使用 spark 结构化流式触发器一次,将增量文件写入 Ignite,结合 spark 结构化流式传输和 ignite。

    https://databricks.com/blog/2017/05/22/running-streaming-jobs-day-10x-cost-savings.html

    https://github.com/apache/ignite/blob/85af9c789a109f7f067145972a82693c7d28b4a9/examples/src/main/spark/org/apache/ignite/examples/spark/IgniteDataFrameWriteExample.scala#L74

    https://github.com/apache/ignite/blob/85af9c789a109f7f067145972a82693c7d28b4a9/examples/src/main/spark/org/apache/ignite/examples/spark/IgniteDataFrameWriteExample.scala#L89

    不确定 spark 是否覆盖 ignite 表 解决方法是在现有 ignite 数据上创建数据框并合并所有最新数据,然后覆盖 ignite 表。

    https://github.com/apache/ignite/blob/85af9c789a109f7f067145972a82693c7d28b4a9/examples/src/main/spark/org/apache/ignite/examples/spark/IgniteDataFrameWriteExample.scala#L113

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2019-03-08
      • 2021-05-23
      • 1970-01-01
      • 2011-04-15
      • 2021-10-04
      • 1970-01-01
      • 2021-10-27
      • 1970-01-01
      相关资源
      最近更新 更多