【发布时间】:2020-11-02 20:08:05
【问题描述】:
我已经看到许多关于基于多个条件返回行的线程,但我正在努力思考最好的方法是 dplyr。我有一个大型的二元数据集和下面的模拟数据。我想返回 x = 1 和 y 值匹配的每个 country1 值的行(在本例中为 10,但不是 11)。
country1 <- c("a", "a", "a", "a")
country2 <- c("b", "c", "b", "d")
x <- c(0,1,1,1)
y <- c(10, 10, 11, 10)
df <- data.frame(country1, country2, x, y)
df
country1 country2 x y
a b 0 10
a c 1 10
a b 1 11
a d 1 10
library(dplyr)
df <- df %>%
group_by(country1)
filter(x==1, y == ?)
我想结束
country1 country2 x y
a c 1 10
a d 1 10
数据集大约有 900,000 行,所以我想匹配所有匹配的 y 值,而不是像上面示例中的 y == 10 那样写出每个值。
【问题讨论】: