【发布时间】:2020-08-03 20:28:46
【问题描述】:
我有一个短语列表,实际上它是一个 Excel 文件,但如果需要,我可以提取每一行。 我需要找到非常相似的行,例如一行可以是:
ANTIBRATING SSPIRING JOINT (type 2) mod. GA160 (temp.max60°)
在我之后的某行可以有同一行或这一行:
ANTIBRATING SSPIRING JOINT (type 2) mod. GA200 (temp.max60°)
就像你可以看到这两条线几乎一样,在这种情况下不相等,但在 98% 主要问题是我必须处理大约 45k 行,因此我正在寻找一种快速且可能是可视化的方式来完成此操作。 我想到的第一件事就是将第一行与第二行进行比较,然后将第三行进行比较直到最后,依此类推,将第二行和第三行进行比较直到最新-1,然后得出一种分数,例如第 1 行是 100% 与第 42 行,99% 与第 522 行 ... 21% 与第 22142 行等... 但这只是一种想法,也许不是最好的。
可能外面已经有不错的程序/脚本/在线服务/程序了,我搜了没找到,所以最后在这里问了。
任何人都知道实现此目的的好方法(如果可能的话)或脚本或在线服务?
【问题讨论】:
标签: string text compare comparison