【发布时间】:2020-07-19 09:47:29
【问题描述】:
我正在使用 sklearn 库中的 ConfusionMatrixDisplay 在我拥有的两个列表上绘制一个混淆矩阵,虽然结果都是正确的,但有一个细节让我感到困扰。混淆矩阵中颜色的密度似乎与实例的数量而不是分类的准确性相匹配。
这是我用来绘制混淆矩阵的代码:
target_names = ['Empty', 'Human', 'Dog', 'Dog&Human']
labels_names = [0,1,2,3]
print(classification_report(y_true, y_pred,labels=labels_names, target_names=target_names))
cm = confusion_matrix(y_true, y_pred,labels=labels_names)
disp = ConfusionMatrixDisplay(confusion_matrix=cm,display_labels=target_names)
disp = disp.plot(cmap=plt.cm.Blues,values_format='g')
plt.show()
现在我从报告和混淆矩阵中得到的结果是:
如您所见,“Dog”和“Dog&Human”类都达到了精度 1,但“Dog”类的颜色是唯一具有浓蓝色的颜色。即使是具有一些错误分类实例的“空”类也具有较深的颜色,使得分类看起来更好。这显然是由于每个类中的数据数量,但是,颜色不应该取决于分类的性能而不是正确检测到的实例数吗?
我尝试对混淆矩阵进行归一化,它解决了这个问题,但我更希望有一个显示实际数字而不是百分比的矩阵。有什么解决办法吗?非常感谢。
【问题讨论】:
标签: python matplotlib scikit-learn confusion-matrix