【发布时间】:2017-08-10 21:04:55
【问题描述】:
我有一个包含多列(ID、编号、位置、字段、重量)的数据框 (df1)。我还有另一个数据框(df2),其中包含更多信息(ID、PassRate、Number、Weight)。
我正在尝试使用 dplyr 和 %in% 过滤掉 df1 中与 df2 具有相同两个值的行。
到目前为止我有:
df_sub <- subset(df1, df1$ID %in% df2$ID & df1$Weight %in% df2$Weight)
但这只是第一个条件的子集……知道为什么吗?
【问题讨论】:
-
df1[paste0(df1$ID,df1$Weight)%in%paste0(df2$ID,df2$Weight),] -
使用
anti_join -
或
merge或inner_join在ID和Weight上...忽略&&评论是不好的。
标签: r statistics dplyr