【发布时间】:2016-04-04 09:47:16
【问题描述】:
我正在使用 3 个不同的分类器执行分类问题,即决策树、朴素贝叶斯和 IBK。我有两个数据集,它们的布局和属性名称相同,但每个数据集的值不同。
Training Set Example;
State
Population
HouseholdIncome
FamilyIncome
perCapInc
NumUnderPov
EducationLevel_1
EducationLevel_2
EducationLevel_3
UnemploymentRate
EmployedRate
ViolentCrimesPerPop
Crime
Rate
8, 0.19, 0.37, 0.39, 0.4, 0.08, 0.1, 0.18, 0.48, 0.27 ,0.68 ,0.2 ,Low
我希望我的决策树根据 ViolentCrimesPerPop 数字(在本例中为 0.2)使用 12 个属性来预测目标类别值是低、中还是高。
我的问题是....在我的测试集上,我是只提供更多相同格式的未见示例,还是应该删除其中一个属性,以便我可以查看它是否学到了什么?
【问题讨论】:
-
嗨@david-buchanan,欢迎来到SO。你做了什么,例如你能告诉我们你的步骤吗?
-
你在weka中选择了属性吗?
标签: classification weka