【发布时间】:2015-01-08 17:36:22
【问题描述】:
我正在尝试为我拥有的大型数据集创建一棵树。我可以很好地运行树并且没有收到错误。但是,当我查看树的标签时,它们非常凌乱且难以辨认。另外,我觉得结果不正确。 (仅供参考,我在下面的代码中取出了一些变量,所以不仅仅是滚动浏览所有变量,问题发生在许多或几个变量上)
例如,EMPLOY1 拆分在 =j 上,但变量中的值是“无法工作”、“退休”等。任何想法我在树输出中做错了什么?
代码:
library(rpart)
fit <- rpat(poorhealth_cat ~
SCNTWRK1+
SCNTLWK1+
SCNTMEAL+
SCNTMONY+
SCNTPAID+
SEX+
SLEPTIM1+
SMOKE100+
SMOKDAY2+
STRENGTH+
TOLDHI2+
USENOW3+
WEIGHT2+
WTCHSALT+
FRT16+
, method="class", data=cdc) # grow tree
printcp(fit) # display the results
plotcp(fit) # visualize cross-validation results
summary(fit) # detailed summary of split
# plot unpruned tree
plot(fit,uniform=TRUE, main="Classification Tree for poorhealth_cat")
text(fit, use.n=TRUE, all=TRUE, cex=.8)
!
【问题讨论】:
标签: r tree decision-tree