【发布时间】:2014-04-16 01:02:28
【问题描述】:
我正在为 Map Reduce 中的每个数据集制作 SVM 模型(为此我使用 LibSVM 库)。甚至,我有每个模型的测试结果。 测试结果文件包含以下详细信息。(IT给出关于测试结果的预测)
+1
-1
+1
+1
..
..
+1
我有这样的 5 个测试文件。现在我想在 map reduce 中使用多数投票结合测试结果。 在地图阶段,我想将行号作为 key 的值。如何在映射阶段为所有测试文件提供行号作为值。
【问题讨论】:
-
这是一项要求,还是您认为这将成为解决方案的一部分?因为我认为你不需要行号。你只需要将我猜的所有这些数字相加,如果正+1获胜。对吗?
-
SVM 通常不太适合在 bagging 集成中使用,因为它们缺乏多样性。在有过拟合倾向的 geteral 分类器中,在 bagged 时往往表现更好。以下演讲很好地讨论了集成分类器中的问题:sandia.gov/~wpk/avi/avatar-tools-background-video.avi
标签: hadoop mapreduce classification svm libsvm