【发布时间】:2015-08-11 23:46:33
【问题描述】:
如何将此数据集与 Weka 一起用于 Apriori 算法?
'A, C, D',
'B, C, E',
'A, B, C, E',
'B, E'
【问题讨论】:
-
如果去掉逗号和引号,就可以和ELKI Apriori IIRC一起使用了。
标签: weka data-mining apriori
如何将此数据集与 Weka 一起用于 Apriori 算法?
'A, C, D',
'B, C, E',
'A, B, C, E',
'B, E'
【问题讨论】:
标签: weka data-mining apriori
您需要将其转换为.arff 格式。
.arff文件的格式很简单,由三个字段组成:
@relation
@attribute
@data
在这种情况下,您只有一个字段(在您的情况下为“字母”),您应该在属性字段中列出所有可能的属性(A、B、C、..),然后对其进行格式化(在数据字段中)使用布尔值描述每行中特定属性的存在/不存在。
例子:
@relation <file_name>
@attribute 'A' { t}
@attribute 'B' { t}
@attribute 'C' { t}
@attribute 'D' { t}
@attribute 'E' { t}
@data
t, ?, t, t, ?
?, t, t, ?, t
t, t, t, ?, t
?, t, ?, ?, t
作为另一个例子,看看Weka数据文件夹中“supermarket.arff”的例子。
【讨论】: