【发布时间】:2020-06-21 10:03:27
【问题描述】:
我有一个包含 3719 行(实际数据)行的数据框和另一个包含 3721 行(来自编码)的数据框。我得到了 2 个额外的观察结果。
我尝试过使用 setdiff,但它给出的行数为零
dplyr::setdiff(d1,d2)
o/p: [1] col1 col2 col3 col4
[5] col5 col6
<0 rows> (or 0-length row.names)
我也试过反之亦然,即
dplyr::setdiff(d2,d1)
o/p: [1] col1 col2 col3 col4
[5] col5 col6
<0 rows> (or 0-length row.names)
如何识别 R 中的那 2 个额外观察?
【问题讨论】:
-
您的“data.frames”是如何定义的? tibbles,tribbles,data.frames,...?也许看到这个问题:github.com/tidyverse/dplyr/issues/4317
-
您可以尝试
which(d1$col1[1:3719] != d2$col1[1:3719])[1]获取col1中的第一个不匹配条目
标签: r dplyr set-difference