【问题标题】:Multiple files process with different output names in RR中具有不同输出名称的多个文件进程
【发布时间】:2021-07-23 04:24:13
【问题描述】:

我有一个 csv 文件的数字数据集(比如 50 个文件):crasha、crashabd、crashd、... 我编写了一个函数来对单个数据进行一些更改和分析。我想要一个动态的输出名称。例如,我想将 newcrasha、newcrashabd、newcrashd 和……作为输出 csv 文件。确实,我想获取导入文件的名称并将其用作输出文件名? 例如:

filenames <- list.files(path = "D:/health/car crash/", pattern = "csv",full.names = TRUE)

analyze <- function(filename) {

  # Input is character string of a csv file.
  crash <- read.csv(file = filename, header = TRUE)

    #merg and summation (crashcounter and NUMBER_INJURED)

newcrash<-crash %>% group_by(COLLISION_DATE) %>% summarise(crashcounter = sum(crashcounter), NUMBER_INJURED = sum(NUMBER_INJURED))
   write.csv( newcrash, "D://health//car crash// newcrash.csv", row.names = FALSE)
 }
filenames <- filenames[1:50]
for (f in filenames) {
  analyze(f)
}

感谢您的帮助

【问题讨论】:

  • 您可以在filenames 上使用lapply,然后只需解析和处理文件名即可保存新文件。

标签: r dynamic filenames


【解决方案1】:

按照@mhovd 的建议试试这个:

filename <- list.files(path = "D:/health/car crash/", pattern = "csv",full.names = TRUE)

analyze <- function(filename) {
  
  # Input is character string of a csv file.
  crash <- read.csv(file = filename, header = TRUE)
  
  #merg and summation (crashcounter and NUMBER_INJURED)
  newcrash<-crash %>% group_by(COLLISION_DATE) %>% summarise(crashcounter = sum(crashcounter), NUMBER_INJURED = sum(NUMBER_INJURED))
  new.name <- paste0("D:/health/car crash/new",basename(tools::file_path_sans_ext(filename)),".csv")
  write.csv( newcrash, file=new.name, row.names = FALSE)
}

lapply(filename[1:50], analyze)

【讨论】:

  • 谢谢你,Elia,我收到以下错误:Paste0(, "D:/health/car crash/new", 中的错误,: 缺少参数,没有默认值。
  • 值得注意的是,我在第一行将“filnames”更改为“filename”。
  • 对不起,我的错。我在paste0(...) 中留下了一个额外的逗号。我已经编辑了我的答案并将“文件名”更改为“文件名”
猜你喜欢
  • 2016-02-04
  • 1970-01-01
  • 1970-01-01
  • 2017-06-04
  • 1970-01-01
  • 1970-01-01
  • 2022-06-14
  • 2013-05-08
  • 2014-12-17
相关资源
最近更新 更多