【发布时间】:2015-06-20 03:35:49
【问题描述】:
我的要求如下:
我们正在尝试为我们的一位客户实施推荐引擎。为了达到同样的效果,我们需要将来自 Web 应用程序的数据存储在 HDFS 中(针对产品的每次点击),并在后端计算推荐并将结果(作为产品)显示在 Web 应用程序中。
我的方法如下突出显示的步骤:
- 我们已经下载并配置了 Cloudera
- 我们已经下载/配置了 Apache Mlib(推荐引擎)
- 使用 Eclipse Luna,我们可以运行 Mlib(使用 Java 插件)
- 现在我们需要创建一个 JSON 服务,该服务将从网络读取数据并
存储在 HDFS 中。我们被困在这一步。 - 现在我们需要创建一个 JSON 服务,它可以从 HDFS 读取数据并 计算推荐值并以 JSON 格式动态显示结果。
我们被困在第 4 步和第 5 步。请建议,我们如何创建 JSON 服务以从 HDFS 读取/写入?
【问题讨论】:
-
我只是模糊地熟悉它,但这听起来可能是对 Flume 的一个很好的使用。链接:flume.apache.org/FlumeUserGuide.html
-
借助 REST 服务,我们得以修复解决方案
标签: java json scala hadoop hdfs