【发布时间】:2020-08-25 23:56:40
【问题描述】:
我有 191 个样本的数据并创建了逻辑回归。我首先使用原始数据运行模型,然后进行上采样。 我无法理解的是:-
- 为什么要在降采样之前进行升采样,或者同时进行升采样和降采样。
- 如果上采样造成过拟合问题,则可以通过缩放数据来处理。
- 在上采样或任何其他采样之后,我必须查看哪些参数才能继续进行另一次采样,例如下采样还是上下采样?
我恳请有人帮助我理解上述内容。
【问题讨论】:
-
不是编程问题,因此这里可以说是题外话;更适合Cross Validated。
标签: machine-learning statistics logistic-regression