【发布时间】:2019-08-20 17:00:23
【问题描述】:
我想计算两个数据框中的列之间的差异。数据框具有不同的总列数,并且数据框之间的列名称具有相似的模式。我想计算名称相似的列之间的差异。
我会很感激一些关于如何开始考虑在 R 或一些示例代码中执行此操作的提示。
以下是数据框的示例:
DF1
w_H_11_XA w_H_13_XA w_H_16_XA w_13_03_XA w_13_12_XA
10 12 1 8 12
11 11 8 6 19
DF2
w_H_11_BA w_H_16_BA w_13_12_BA
8 1 10
9 4 9
因此,这两个数据集都有“共同”列 w_H_11*、w_H_16* 和 w_13_12*,这意味着它们在列名中具有相似的模式。我想生成一个数据集,它只获取相似匹配列之间的差异。像这样:
w_H_11 w_H_16 w_13_12
2 0 2
2 4 10
我考虑过合并数据框并按名称顺序排列列;但是,我不确定如何自动计算差异。实际的数据集有几百列。
如果有任何反馈,我们将不胜感激。
【问题讨论】: