【发布时间】:2018-08-16 03:19:58
【问题描述】:
我有一个数据集 (df),其中包含 10000 条推文和 2 个观察值(正文和标签);前 4000 条推文被标记(正面或负面),我想用它作为训练集来预测其余推文的标签,测试,根据文本正文。 我想使用随机森林算法来预测(插入符号包)和交叉验证以确定准确性。 我使用了这个脚本:
training <- subset(df[1:4000,])
testing <- subset(df[4001:10000,])
fitControl1 <- trainControl(method = "repeatedcv",
number = 10,
repeats = 10)
rfFit <- train(training$label~ training$body, data = training,
method = "rf",
trControl = fitControl,
verbose = FALSE)
但这是来自控制台的错误
Error: cannot allocate vector of size 7.5 Gb
我该如何解决? 提前致谢
【问题讨论】:
标签: r machine-learning random-forest