【发布时间】:2017-12-17 03:07:27
【问题描述】:
我正在与堆叠学习者一起工作。根据H2OStackedEnsembleEstimator h2o 的文档,python 实现允许您轻松构建集成模型。然而,这仅限于构建具有相同基础训练数据的基础分类器。我有基于时间的功能,其最短日期因数据源而异。每个数据样本都是一个时间点。为了尽可能多地利用数据,我将特征分成两组(取决于相关性和最短日期)并训练两个单独的模型。我想组合这些模型,但 H2OStackedEnsembleEstimator 要求功能相同。
根据this post 关于 R 的堆叠集成实现,可以选择只执行元学习步骤,这应该只需要每个基本模型的 k 折交叉验证预测和真实目标值。
以防万一……对于我的特定问题,我意识到我将遇到与最小日期不匹配的元学习步骤的问题,我有想法来规避这个问题。
【问题讨论】:
标签: python r h2o ensemble-learning