【问题标题】:Spark cluster: Standalone mode without HDFSSpark 集群:无 HDFS 的独立模式
【发布时间】:2015-12-17 08:32:28
【问题描述】:

我们有一个独立的 Spark 集群。对于集群,如果 RDD 内存存储不足,它会将数据溢出到磁盘。没有 HDFS 的情况下,数据究竟会溢出到哪里?每个从节点的本地磁盘?

谢谢!

【问题讨论】:

    标签: memory apache-spark rdd


    【解决方案1】:

    据我所知,所有数据都会溢出到spark.local.dir 定义的本地目录,与 HDFS 访问无关。

    【讨论】:

      猜你喜欢
      • 2018-01-14
      • 2017-12-03
      • 1970-01-01
      • 1970-01-01
      • 2015-04-30
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多