【问题标题】:Find a match between two columns of two files在两个文件的两列之间查找匹配项
【发布时间】:2015-05-21 09:07:42
【问题描述】:

我有两个文件:

file 1:
a1 45 1/1 895
a1 65 0/1 478
a1 80 1/1 474
a2 45 0/1 145
a3 50 1/1 415
a3 32 0/1 547

file 2:
a1 45 1/1 784
a1 65 0/1 454
a1 89 1/1 354
a1 105 0/1 365
a2 45 0/1 478
a2 65 0/1 985
a3 32 0/1 658
a3 65 0/1 985

我想比较文件 1 和文件 2 的两列,并且只有当两者都匹配时,我才想打印文件 1 中的整行。

output:
a1 45 1/1 895
a1 65 0/1 478
a2 45 0/1 145
a3 32 0/1 547

这是我在 awk 中考虑的解决方案:

awk 'FNR==NR{a[$1$2];next} (($1$2 in a))' file1 file2

我想知道在 bash 中是否还有其他方法可以做到这一点。 谢谢!

【问题讨论】:

  • 您将很难找到一种更简洁的方法,如下面的grep。
  • 我刚刚编辑了这个问题,因为我的文件中有两列以上,其他列不需要匹配。

标签: bash awk


【解决方案1】:

如果需要匹配整行,那么grep -f 是更简单的选项:

grep -Ff file1 file2
a1 45
a1 65
a2 45
a3 32

编辑:

awk 'FNR==NR{a[$1,$2];next} (($1,$2) in a)' file1 file2
a1 45 1/1 784
a1 65 0/1 454
a2 45 0/1 478
a3 32 0/1 658

【讨论】:

  • 谢谢,问题是在原始文件中,我有超过 2 列,它们不需要匹配,我现在要编辑问题。
  • 太好了,谢谢。你介意解释一下你的命令吗?我看到的是第一列和第二列被存储在一个数组中,对吗?
  • @anubhava 很高兴看到你擅长击中移动目标:p
  • @user1945881:它与您尝试的命令非常相似,不同之处在于使用逗号作为分隔符形成复合键。
猜你喜欢
  • 1970-01-01
  • 2015-05-23
  • 2021-06-23
  • 1970-01-01
  • 2018-07-12
  • 1970-01-01
  • 2019-11-27
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多