【问题标题】:Apache Storm vs Apache Samza vs Apache Spark [closed]Apache Storm vs Apache Samza vs Apache Spark [关闭]
【发布时间】:2017-03-29 18:11:44
【问题描述】:

我曾在 Storm 和 Spark 上工作过,但 Samza 还很新。

我不明白为什么在 Storm 已经可以进行实时处理的情况下引入 Samza。 Spark 在内存中提供近乎实时的处理,并具有其他非常有用的组件,例如 graphx 和 mllib。

Samza 带来了哪些改进以及可能的进一步改进?

【问题讨论】:

标签: apache-spark apache-storm apache-samza


【解决方案1】:

This 很好地总结了差异和优缺点。

我只想补充一下 Samza,它实际上并不是那个新的,它带来了一定的简单性,因为它坚持使用 Kafka 作为其后端,而其他人则试图在简单的代价。 Samza 是由创建 Kafka 的同一个人开创的,他们也是 Kappa Architecture 背后的同一个人——主要是前 LinkedIn 的 Jay Kreps。这很酷。

此外,使用 Samza 的实时流、Spark Streaming 中的微批处理(与 Spark 不完全相同)以及 Storm 中的带有元组的 spout 和 bolt 之间的编程模型完全不同。

这些都不是“更好的”。这完全取决于您的用例、团队的实力、API 如何与您的心智模型相匹配、支持质量等。

您还忘记了 Apache Flink 和 Twitter 的 Heron,因为 Storm 开始让他们失望了。话又说回来,很少有人需要以 Twitter 的规模运营。

【讨论】:

猜你喜欢
  • 2018-07-08
  • 2015-05-19
  • 1970-01-01
  • 2015-05-20
  • 2014-08-25
  • 2010-11-29
  • 2017-01-16
  • 2012-07-07
  • 1970-01-01
相关资源
最近更新 更多