【发布时间】:2019-09-11 03:36:44
【问题描述】:
我拥有的数据有两列的值应该匹配。由于行数太多,我必须执行以下操作:
- 加载两列
- 比较
A和B以查找匹配值 - 将列
A和B的输出堆叠到两个新列中,这样匹配的值并排,不匹配的值位于每列的末尾。
是否有更快的方法来执行此操作,使其适用于任何类型的数据(整数、浮点数或字符)比较?
输入数据表
A B
1 1
2 3
3 4
4 5
5 6
6 7
7 8
8 9
9 10
10 11
输出数据表
C D
1 1
3 3
4 4
5 5
6 6
7 7
8 8
9 9
10 10
2 11
【问题讨论】:
-
你能解释一下你的最终目标吗?我不理解请求的输出格式的目的,理解这可能有助于找到合适的解决方案。
-
@JonSpring - 有两列。我想为每一行值将这两列相互匹配,然后并排打印每列中匹配值的输出,而不是在末尾使用
NA匹配值以使两列的行数相同. -
到目前为止你尝试过做什么?
-
@ethanpasta - 我尝试先从
A列循环遍历每一行并使用which(data$A == data$B),然后对B列执行相同操作。但这在大数据上花费的时间太长了。
标签: r sorting dataframe datatable