【发布时间】:2015-01-06 09:42:21
【问题描述】:
我想要做的是在特定日期对大型 .csv 文件进行子集化以提取特定年份。
到目前为止,我所做的是使用 fread 读取整个 .csv 文件,然后按日期读取子集。
下面是一个示例(注意我生成了一些示例数据,而不是使用 fread 读取它):
# Example data.table created after reading in from fread
library("data.table")
DT <- data.table(seq(as.Date("1999-01-01"), as.Date("2009-01-01"), by="day"))
DT$Var <- sample(1000, size=nrow(DT), replace=TRUE)
colnames(DT) <- c("Date", "Var")
# subset to extract data for the year 2004
DT_2004 <- subset(DT, Date %in% as.Date("2004-01-01"):as.Date("2004-12-31"))
这可行,但需要我先读入整个 .csv 文件,对于非常大的 .csv 文件,这非常耗时。有没有办法在 fread 中保留 .csv 文件,以便我只读取我想要的日期?
谢谢。
【问题讨论】:
标签: r data.table fread