【发布时间】:2016-01-29 15:46:27
【问题描述】:
我目前正在试用 Spark 流式传输。我已经能够获得所需的结果,但现在我只是在终端上打印:
myResults.print()
将结果打印到终端。
我想要实现的是类似于this 的架构。
有没有办法将这些结果写入数据库中的表。 我该怎么做?我应该使用哪个数据库?
【问题讨论】:
标签: scala hadoop apache-spark bigdata spark-streaming
我目前正在试用 Spark 流式传输。我已经能够获得所需的结果,但现在我只是在终端上打印:
myResults.print()
将结果打印到终端。
我想要实现的是类似于this 的架构。
有没有办法将这些结果写入数据库中的表。 我该怎么做?我应该使用哪个数据库?
【问题讨论】:
标签: scala hadoop apache-spark bigdata spark-streaming
我应该使用哪个数据库?
这完全取决于您对数据的处理要求,一旦数据被持久化到磁盘上。您可以选择任何适合您需要的数据库,从 Mysql、Oracle、MongoDB 等。或者您可以将其保存到 Hadoop 文件系统。
我该怎么做?
您可以使用 Spark Map 函数遍历所有数据并插入到您选择的数据库中。喜欢
statuses.foreach(new VoidFunction<String>() {
@Override
public Void call(String s) throws Exception {
//You Code to parse the String and insert into the database of your choice.
}
});
希望有帮助
【讨论】:
【讨论】: