【发布时间】:2019-08-29 02:29:35
【问题描述】:
在训练任何分类器之后,分类器告诉数据点属于一个类的概率。
y_pred = clf.predict_proba(test_point)
分类器是预测具有最大概率的类,还是将概率视为根据分布绘制的分布?
换句话说,假设输出概率是-
C1 - 0.1 C2 - 0.2 C3 - 0.7
输出总是 C3 还是只有 70% 的时间?
【问题讨论】:
-
很难回答这个问题,因为每个分类器的工作方式都不同(有些没有 predict_proba 方法),但一般来说,您的分类器将始终回答 C3。然而它警告你,在你的训练中,类的分布在样本的周围是这样的(封闭空间)。但是周围真的没有很好的定义,再次取决于分类器
标签: machine-learning scikit-learn deep-learning classification