【发布时间】:2015-11-03 20:37:39
【问题描述】:
我有一个fortune 的数据文件,其中包含许多重复的命运。我想删除它们。
财富由% 描述,因此财富文件样本可能如下所示:
%
This is sample fortune 1
%
This is
sample fortune 2
%
This fortune
is repeated
%
This is sample fortune 3
%
This fortune
is repeated
%
This fortune
is unique
%
如您所见,财富可以跨越多条线,使solutions here 无用。
我该怎么做才能找到并消除重复的命运?我想找到一种方法让awk 忽略以% 开头的行,但是有些财富共享相同的行但总体上并不相同(例如我示例中的最后两个),所以这还不够。
到目前为止,我一直在尝试使用 awk 解决这个问题,但任何工具都可以。
【问题讨论】:
标签: bash duplicates