【发布时间】:2019-07-30 14:56:26
【问题描述】:
对于包含 99150000 行的大型数据帧,以下代码将数据 my_df 拆分为 1000 行的块并写入磁盘。
lapply(seq(1, nrow(my_df), by = 1000),
function(i) write.table(my_df[i:i+1000-1,]
, file = paste0('path_to_logal_dir/data'
, i, '-', i+1000-1, '.csv')
,row.names = F,col.names = F,quote = F)
)
现在,我有相同的字符格式数据(99150000 个元素),示例数据如下:
[1] "1979_1,532,40,7.7,12.9,116.9,12.9,85,2,2.001,4,25,55,5.3,55,85,7.7,85,145,7.5,145,265,5.0"
[2] "1979_2,532,40,7.7,12.9,116.9,12.9,85,2,2.001,4,25,55,5.3,55,85,7.7,85,145,7.5"
[3] "1979_3,532,40,7.7,12.9,116.9,12.9,85,2,2.001,4,25,55,5.3,55,85,7.7,85"
...
[99150000] ...
如何实现上述相同的任务,即将字符格式数据拆分成块(包含 1000 行的文件)?
【问题讨论】: