【问题标题】:Text Mining Using Rapidminer使用 Rapidminer 进行文本挖掘
【发布时间】:2013-11-17 11:13:50
【问题描述】:

我有一个 Excel 表,其中每一行都表示和问题及其描述。与每一行对应的一列表示有关该问题的详细信息,这是我想要挖掘的。我想找出每个单元格中每个标记的出现,然后相应地对每一行进行分类(例如,如果特定标记出现超过 x 次,我将用该标记标记该行)。当我使用 Rapidminer 执行此操作时,它会将所有行放在一起并告诉每个令牌在所有行中出现的次数,而不是一次获取每一行。如何让 Rapidminer 一次获取每一行并确定每一行的令牌频率并应用 n 克等...

【问题讨论】:

    标签: nlp text-mining rapidminer


    【解决方案1】:

    听起来您正在使用 Process Documents from Data 运算符,输入来自电子表格,其属性设置为文本类型。在这个算子里面,有一个Tokenize算子。

    如果您将 Process Documents 运算符的参数设置为“术语出现次数”,您将获得令牌在示例集中出现的次数。

    【讨论】:

      猜你喜欢
      • 2013-06-14
      • 2015-08-04
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2011-02-16
      • 2013-03-26
      • 1970-01-01
      相关资源
      最近更新 更多