【发布时间】:2015-03-31 20:29:53
【问题描述】:
我是集群计算的新手,我正在尝试在 Spark 中设置一个最小的 2 节点集群。 我仍然有点困惑:我是否必须首先设置完整的 Hadoop 安装,或者 Spark 是否附带包含 Hadoop 版本?
我发现的关于 Spark 的资料并没有真正说明这一点。我知道 Spark 是作为 Hadoop 的扩展而不是替代它,但我不清楚它是否需要独立运行的 Hadoop 系统。
我需要一个 HDFS,因此仅使用 Hadoop 的文件系统部分就足够了吗?
有人可以向我指出这个可能很明显的事情吗?
【问题讨论】:
标签: hadoop apache-spark