【问题标题】:Finding out wrongly classified instances when using WEKA使用 WEKA 时找出错误分类的实例
【发布时间】:2012-05-25 16:02:21
【问题描述】:

我正在使用 WEKA 的 GUI 版本,并且正在使用朴素贝叶斯进行分类。谁能告诉我如何找出哪些实例被错误分类。

【问题讨论】:

    标签: weka


    【解决方案1】:

    在您的输出中应该有一个带有数字和百分比的错误分类部分,应该就是这样。 image 中的红色框就是您要查找的内容。 编辑:原图来源here

    【讨论】:

    • 我想他/她想知道是否有可能看到个别错误分类的实例。
    • 是的。这是我的错。再读一遍,你肯定是对的。
    【解决方案2】:
    1. 在 Weka 资源管理器中转到分类选项卡
    2. 点击更多选项...
    3. 检查输出预测
    4. 点击确定

    希望对您有所帮助。

    【讨论】:

    • 信息丰富,但是据我所知,在使用交叉验证时这并不能真正起作用,因为无法将 Weka 的错误分类实例的输出链接到原始实例
    • 您似乎缺少 ID 属性。检查@Menezes Sousa 的答案。第 6 步对我来说是关键。
    【解决方案3】:

    我之前也遇到过同样的问题,现在我可以很好地解决它。 我的做法如下:

    1. 创建一个字符串属性,为每个实例分配一个唯一的 ID。一世 已将文件的名称分配给我的每个实例。
    2. 生成 WEKA 支持的 .arff 文件。
    3. 当您必须对此 .arff 数据运行分类器时,您会注意到您必须排除 Instance ID 属性。如果不这样做,Weka 会弹出一个错误,说分类器无法处理 String 属性。不是排除,而是在 InstanceID 上运行过滤器 StringToNominal。
    4. 现在,正如@Rushdi 所说,点击分类选项卡上的“更多选项”。
    5. 在“分类器评估选项”弹出窗口中检查输出预测。
    6. 在“输出附加属性”框中输入实例 ID 的属性号。
    7. 对整个数据运行分类器,不包括实例 ID 属性。 (大多数分类器在“Ranker”中将其作为一个名为“StartSet”的选项,例如我与 SMO 分类器一起使用。)
    8. 如果到目前为止您已正确完成所有操作,您将看到列出的所有实例及其真实和预测的输出值,以及可以准确告诉您哪些文档被错误分类的实例 ID。

    希望这对某人有所帮助。 祝你好运!

    【讨论】:

    • 这看起来很理想。但是 Simple Logistic 没有选项 StartSet
    • 使用过滤分类器。
    【解决方案4】:

    这对我有用:

    1. 反编译官方weka.jar
    2. 在库中搜索您要测试的分类,了解其工作原理并确定哪些实例被错误分类。

    【讨论】:

      猜你喜欢
      • 2011-12-10
      • 2019-12-08
      • 2014-05-26
      • 2012-03-25
      • 2015-06-25
      • 2013-05-13
      • 2017-12-28
      • 2015-01-27
      • 1970-01-01
      相关资源
      最近更新 更多