【问题标题】:subseting columns from a data frame in RR中数据框的子集列
【发布时间】:2014-11-28 13:54:32
【问题描述】:

我有一个巨大的数据框,但我只需要处理一些列。我的代码:

outcome_data<- read.csv("dat.csv", colClasses= "character")
interested_data<- outcome_data[, c(1, 2, 7, 11, 17, 23)]

当我在我的函数中运行它时给我这个错误:

data.frame(list(Provider.Number = c("450690", "450358", "450820", : 参数暗示不同的行数:370, 0

但在交互模式下工作正常。 还有其他选择吗?或者如何解决这个问题?

【问题讨论】:

  • 如果列数不太大,能否显示str(outcome_data)
  • 有些东西你没有给我们看。无论如何,您可能只想阅读感兴趣的列。 help("read.table") 解释了如何在导入期间跳过列。
  • R 甚至是在非交互模式下导入数据吗?在创建 interested_data 之前进行逻辑检查。

标签: r csv subset


【解决方案1】:

data.table:::fread(data, select, ...)


选择要保留的列名或数字的向量,删除其余部分。 等等。

fread(data, select=c("A","D")) 
fread(data, select=c(1,4))

【讨论】:

    猜你喜欢
    • 2021-12-16
    • 2016-11-04
    • 2018-05-18
    • 2012-11-18
    • 2018-11-24
    • 1970-01-01
    • 2020-11-21
    • 2015-10-04
    • 2018-11-18
    相关资源
    最近更新 更多