【发布时间】:2021-07-06 01:39:34
【问题描述】:
我创建了一个随机森林
library(randomForest)
...
rf_default <- train(Species~.,
data=test,
method='rf', #random forest
metric='Accuracy',
tuneGrid=tunegrid,
ntree=100,
trControl=control)
rf_default$finalModel
rf_default$finalModel 现在包含具有最佳参数的模型。现在,我想用新数据重新训练具有最佳参数的模型(类似于scikit 中的*.fit())。我该怎么做?
编辑:
我遵循here 描述的方法:我尝试使用 CV 来查找超参数,然后,我想使用它们在完整的训练集上创建模型
【问题讨论】:
-
rf_default$finalModel接受了您作为数据参数提供的所有数据的训练。如果这不能回答您的问题,那么我不确定我是否理解您为什么要使用在一个数据集上优化的超参数来在另一个数据集上训练模型? -
我不知道 - 请添加为答案以便我检查
-
你可以使用
predict(rf_default, new_data)这种方式,如果你执行了任何预处理,它也会在new_data上执行。
标签: r random-forest r-caret