【问题标题】:Sklearn: Choose naive bayes model for continous feature, multiple labelsSklearn:为连续特征、多个标签选择朴素贝叶斯模型
【发布时间】:2021-07-19 23:53:52
【问题描述】:

假设我有一个数据集,其特征值是连续的,并且有两个以上的可能标签(例如:雨、晴、风等),我应该在 sklearn 中实现哪种朴素贝叶斯模型?

我正在考虑高斯或多项式。但是多项式适用于离散特征,我尝试了高斯,但结果发现预测的准确性就像随机选择一样。

感谢您的帮助, 一哥

【问题讨论】:

  • 您能否编辑问题以包含数据样本?从问题中不清楚输入/输出功能是什么样的。

标签: python machine-learning scikit-learn naivebayes


【解决方案1】:

朴素贝叶斯分类 (NBC) 适用于离散值。 这意味着您必须离散化所有连续的特征。更多详情,this could help

无论如何,多项式是正确的,因为您有多个标签。但您也应该记住,您必须对标签进行一次性编码 (OneHotEncoder in sklearn)。

【讨论】:

    猜你喜欢
    • 2018-12-24
    • 2014-01-03
    • 2013-09-09
    • 2019-02-21
    • 2017-11-10
    • 2019-04-29
    • 2018-12-15
    • 2017-11-13
    • 2015-01-24
    相关资源
    最近更新 更多