【发布时间】:2012-01-06 05:21:45
【问题描述】:
我有两个 csv 文件:
csv1 <- data.frame(y=c("classA", "classB", "classA", "classB", "classA", "classC"),
DBID=c("d1", "d1", "d2", "d3", "d3", "d3"))
y DBID
1 classA d1
2 classB d1
3 classA d2
4 classB d3
5 classA d3
6 classC d3
csv2 <- data.frame(tm=c("t1","t1","t2"),
y=c("classA","classC","classB"))
tm y
1 t1 classA
2 t1 classC
3 t2 classB
我想通过匹配两个csv文件中的y列来提取信息以获取表格,即
t1 在 csv2 文件中有 classA 和 classC,因此,所有在 csv1 中归类为 classA 的 DBID(d1、d2 和 d3)都列在结果数据框中,第一列是 t1,第二列是 d1、d2 和 d3专栏
t2 在 csv2 文件中具有 B 类,因此,所有在 csv1 中分类为 B 类的 DBID(d1 和 d3)都列在结果数据框中,其中 t2 列在第一列,d1 和 d3 列在第二列。
并得到如下数据框:
tm DBID endcol
t1 d1 1
t1 d2 1
t1 d3 1
t1 d3 1
t2 d1 1
t2 d3 1
请指导如何使用 R。
【问题讨论】: