【问题标题】:Association Rules for Text File文本文件关联规则
【发布时间】:2016-04-18 15:10:29
【问题描述】:

我是一名使用 Rapidminer 的学生,我正在使用 Yummly 的 What's Cooking 数据集 (https://www.kaggle.com/c/whats-cooking/data) 做一个项目。该数据集有 20 种不同的美食类型(例如意大利、中国、印度等)。

我们的目标是开发一种数据挖掘模型,通过分析菜肴的配料表来识别未来菜肴的菜肴类型。我们正在使用关联规则来做到这一点。但是,我不断收到“未找到规则”并且不知道为什么。我认为这与我的属性被格式化为文本而不是使用名义到二项式运算符有关,但我不确定如何解决它。

目前我的流程看起来像......

数据->选择属性->FP增长->创建关联规则

你能帮忙吗?

【问题讨论】:

    标签: rapidminer


    【解决方案1】:

    根据 FP-Growth 算子的文档,示例集中的所有属性都需要是二项式的。

    我承认——我没有直接查看数据,因为我不想在 kaggle 上注册一个帐户,所以我不确定它的格式,但你可能想要设置烹饪类型作为标签,然后让每个剩余属性代表一个或多个食谱中包含的每种成分。如果使用该成分,每道菜的列中将显示 1,如果未使用,则该列中将显示 0。 (取决于数据的原始格式,因为您提到它是文本,您可能需要查看文本处理扩展,它可以创建一个像我刚刚描述的示例集。)然后,如果您将 0 和 1 转换为二项式,你应该可以使用 FP-Growth。

    【讨论】:

      猜你喜欢
      • 2016-12-03
      • 2014-12-07
      • 1970-01-01
      • 1970-01-01
      • 2015-04-29
      • 2019-09-07
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多