【发布时间】:2014-10-13 07:00:29
【问题描述】:
我正在编写一个文件来预测被诊断患有糖尿病的患者的治疗方法(级别从 1 到 10)。 有 8 种不同的治疗建议(256 种可能的结果),我需要对它们进行聚类(我有来自原始文件的 21 个属性。)。所以我用 19 k 和 SimpleKMean。问题是我为某些集群分配了“无类”;
此外,当我对其进行分类以进行评估时,我遇到了相同的问题“没有集群”分配给类,并且我丢失了一些数据。例如有 940 个实例,但分类后我有 876 个。
但混淆矩阵会显示准确的数字。我不知道它是否相关,但它可能有助于解决问题。我使用了 AddCluster 方法,因为我的所有属性都是数字的,并且我需要原始文件中的一个附加列才能显示“Treatment Cluster”(第 22 个属性)。所以我使用这个新的附加属性运行 SimpleKMean 和交叉验证,这也是我的类。
非常感谢您的帮助!!!
【问题讨论】:
标签: weka