【问题标题】:R lapply access elements of a list and perform calculationsR lapply 访问列表的元素并执行计算
【发布时间】:2017-10-31 13:03:24
【问题描述】:

我有一个大约 561 个元素的列表,每个元素都是一个列表,在调用时看起来像一个矩阵。下面是数据集中的一个例子,

structure(list(`111110` = structure(c(205, 4, 1, 6, 23, 0, 1, 
0, 0), .Dim = c(3L, 3L), .Dimnames = list(c("1", "4", "5"), c("1", 
"4", "5"))), `111120` = structure(c(181, 3, 4, 4), .Dim = c(2L, 
2L), .Dimnames = list(c("1", "4"), c("1", "4"))), `111130` = structure(c(71, 8, 3, 15, 114, 7, 6, 8, 56), .Dim = c(3L, 3L), .Dimnames = list(
c("1", "4", "5"), c("1", "4", "5"))), `111140` = structure(c(87, 
8, 9, 14), .Dim = c(2L, 2L), .Dimnames = list(c("1", "4"), c("1", 
"4"))), `111150` = structure(24, .Dim = c(1L, 1L), .Dimnames = list(
"1", "1")), `111160` = structure(48, .Dim = c(1L, 1L), .Dimnames = list(
"1", "1"))), .Names = c("111110", "111120", "111130", "111140", 
"111150", "111160"))

列表中每个元素的尺寸为 1 x 1 到 6 x 6。我想对列表中的每个元素进行以下计算:

  1. 如果条目有一个名为“5”的列,那么我想对“5”列中的条目求和,但“5”列最后一行中的条目除外。如果没有“5”列,则计算应为空白。

  2. 如果条目有一个名为“5”的列,则对列“1”中的元素求和,但第一个元素除外。如果相关条目没有以“5”作为标题的列,则它应该是空白的。

  3. 获取第 1 部分和第 2 部分中的计算并将它们添加到包含唯一 id 和第 1 和第 2 部分的计算的数据框中。

我尝试了以下方法(基于下面提供的答案):

output <- c()
for(x in names(trans.by.naics)) {
  id <- x
  count.entry.5 <- ifelse("5" %in% colnames(trans.by.naics[[x]]),
                            sum(trans.by.naics[[x]][1 :nrow(trans.by.naics[[x]]), 5]) - trans.by.naics[[x]][5,5], "") # sum down the first four rows of column "5" if it exists
  count.entry.1 <- ifelse("5" %in% colnames(trans.by.naics[[x]]),
                     sum(trans.by.naics[[x]][1 : nrow(trans.by.naics[[x]]), 1]) - trans.by.naics[[x]][1,1], "") 
  thing <- data.frame(id, count.entry.5, count.entry.1)
  output <- rbind(output, thing)

}

但是当我运行我的代码时得到以下信息:

Error in trans.by.naics[[x]][1:nrow(trans.by.naics[[x]]), 5] : 
  subscript out of bounds

所需的输出如下所示:

      id count.entry.5 count.entry.1
1 111110             1             5
2 111120                           3
3 111130            14            11
4 111140                            
5 111150                            
6 111160

有没有一种不会花费太长时间的好方法?也许是一种更加矢量化的方法? lapply 方法?任何建议或帮助表示赞赏。谢谢!!

【问题讨论】:

标签: r matrix sum lapply


【解决方案1】:
output <- c()
for (x in names(data)) {
  id <- x
  if(sum(colnames(data[[x]]) %in% "5") == 1) {
    calc1 <- sum(data[[x]][-nrow(data[[x]]), "5"])
    calc2 <- sum(data[[x]][-1, "1"])
  } else {
    calc1 <- NA
    calc2 <- NA
  }
  thing <- data.frame(id, calc1, calc2)
  output <- rbind(output, thing)
}

【讨论】:

  • 您的数据的第二个元素没有“5”列...因此输出并不完全相同,但可以满足您的要求。
  • 我不太明白这条线...if(sum(colnames(data[[x]]) %in% "5") == 1 线。为什么要对列名求和?
  • 我问是因为在 6 X 6 的情况下 calc1 的计算不正确,即使它在 colnames[[data]] 中确实有一个“5”——它添加了列“5”的最后一行"
  • 几个 FALSE 之和为 0,但如果其中任何一个为 5,则 TRUE 之和为 1。将 6 x 6 与所需的输出相加。
  • 啊,我明白了。聪明又干净。我占了 6 X 6 的情况:calc1 &lt;- sum(trans.by.naics[[x]][, "5"]) - trans.by.naics[[x]]["5", "5"]
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2021-05-17
  • 1970-01-01
  • 1970-01-01
  • 2019-07-23
  • 1970-01-01
相关资源
最近更新 更多