【发布时间】:2020-01-14 12:08:55
【问题描述】:
我有一个文件夹,里面有几个 tsv 格式的数据帧文件(df1.txt、df2.txt、df3.txt...等)。我需要提取每个df(“freq”,“cdr”)中两列的数据并将它们聚合到一个带有两列的大型tsv数据帧中,加上第三个表示它们来自哪里的文件名( “文件”、“cdr”、“频率”)。
Individual df1: "xxx" "freq" "cdr" "zzz"
23 0.112 abc ej
25 0.743 bbc tj
final df: "file" "freq" "cdr"
df1 0.112 abc
df1 0.743 bbc
df2 0.444 abd
df2 0.911 ccd
我尝试使用“list.files”,但这只是让我得到文件 (df) 名称的列表。我曾想过使用“解析”,但我不确定这个函数是如何工作的。作为 R 新手,我非常感谢您的帮助。
data.all <- list.files("/mnt/data/OUTPUT/", pattern="*.txt", full.names = TRUE)
sdata <- data.all[, "file", "freq", "cdr"
单个df1:“xxx”“freq”“cdr”“zzz” 23 0.112 abc ej 25 0.743 英国广播公司 tj
最终df:“文件”“频率”“cdr” df1 0.112 ABC df1 0.743 英国广播公司 df2 0.444 abd df2 0.911 ccd
【问题讨论】: