【发布时间】:2014-11-18 00:41:53
【问题描述】:
我有一个data.frame data_qual,看起来像这样:
data_qual <- structure(list(NAME = structure(1:3, .Label = c("NAME1", "NAME2", "NAME3"), class = "factor"), ID = c(56L, 47L, 77L), YEAR = c(1990L, 2007L, 1899L), VALUE = structure(c(2L, 1L, 1L), .Label = c("ST", "X"), class = "factor")), .Names = c("NAME", "ID", "YEAR", "VALUE"), class = "data.frame", row.names = c(NA, -3L))
NAME ID YEAR VALUE
1 NAME1 56 1990 X
2 NAME2 47 2007 ST
3 NAME3 77 1899 ST
我想通过将 data_qual 与另一个数据框 dat 进行比较来过滤掉来自 data_qual 的值:
dat <- structure(list(NAME = structure(c(1L, 1L, 1L, 2L, 2L, 2L, 2L), .Label = c("NAME1","NAME2"), class = "factor"), ID = c(56L, 56L, 56L, 47L, 47L, 47L, 47L), YEAR = c(1988L, 1989L, 1991L, 2005L, 2006L, 2007L, 2008L), VALUE = c(45L, 28L, 28L, -12L, 14L, 23L, 32L)), .Names = c("NAME", "ID", "YEAR", "VALUE"), class = "data.frame", row.names = c(NA, -7L))
NAME ID YEAR VALUE
1 NAME1 56 1988 45
2 NAME1 56 1989 28
3 NAME1 56 1991 28
4 NAME2 47 2005 -12
5 NAME2 47 2006 14
6 NAME2 47 2007 23
7 NAME2 47 2008 32
我如何根据ID 列过滤data_qual,以便在第一个过滤过程中,只有行被写入新的data.frame,其中ID 与dat 匹配?
NAME ID YEAR VALUE
1 NAME1 56 1990 X
2 NAME2 47 2007 ST
然后,我正在寻找一种方法,从生成的 data.frame 中只写出每组不具有相同 YEAR 的行(由 ID 定义)
NAME ID YEAR VALUE
1 NAME1 56 1990 X
感谢任何帮助。
【问题讨论】:
-
您对中间步骤感兴趣还是直接对最后一步感兴趣?
-
中间步骤会很好看,这样我可以更好地控制我的数据。
标签: r filter compare dataframe matching