【发布时间】:2018-06-13 22:44:18
【问题描述】:
我有兴趣仅对两个特定变量具有相同值和另一个变量具有两个不同值的行子集进行计算。
对于这个玩具数据集:
library(data.table)
DT = data.table(x = c(1,1,1,1,2,2,2,2,3,3,3,4,4,4,4,5,5,5,5,5),
y = c(10,10,10,10,24,24,26,26,51,51,51,34,34,34,34,65,65,65,65,65),
z = c('m', 'm', 'f', 'f', 'b', 'b', 'm', 'm', 'b', 'b', 'b',
'm', 'm', 'f', 'f', 'b', 'b', 'b', 'b', 'b'))
我只对给定 x 值和 y 值的行感兴趣,其中 z 等于“m”和“f”。所以在这个表中,我需要一个脚本来提取 x=1 和 x=4 的行,因为这些是唯一 y 保持不变且 z 同时具有 'f' 和 'm' 值的行。如果 z 有一个“b”值,或者只有“f”或“m”,我不需要它。
【问题讨论】:
标签: r data.table subset