【发布时间】:2021-10-26 16:58:09
【问题描述】:
例如,我想拆分一个包含 1,079,882 行的数据帧,从 1,048,575 开始,然后是下一个 1,048,575
我试图做这样的事情
x<-split(df, rep(1:1048575, 1048575))
list2env(x,envir = .GlobalEnv)
但它不起作用。根据我想要做的,我应该得到 2 个数据框。如果我的数据框有 2,097,160 我应该有三个,前两个有 1,048,575 行,第三个有 5 行。
【问题讨论】:
-
你完全正确。那不应该在那里。
-
看来这是stackoverflow.com/q/7060272/3358272的骗子; @user35131,这对你也有用吗?
-
我正在尝试这样做,但它不起作用。
-
rep函数接受各种参数,包括times=、each=和length.out=;您的使用默认为times=,这意味着您想要1:1048575(1e6 长),每个值重复 1e6 次......所以您将 1,079,882 行帧由1e6 * 1e6(1e12)数字分割,这正在爆炸您的数据。 -
仅供参考,“但它不起作用” 不是很清楚;虽然我认为我们已经弄清楚它为什么不起作用,但在未来请证实这样的陈述。