【发布时间】:2013-05-03 23:32:03
【问题描述】:
我正在使用FuzzyWuzzy String Matching module from SeatGeek。
我发现在使用 token_set_ratio 搜索算法时,大小写的微小差异会产生截然不同的结果。
例如,如果我在文件中查找短语“我正在吃饭”,我会得到 100% 的匹配。但如果短语是“我在吃”,仅 ONE 字母的大小写变化,我就有 65% 的匹配度。
有没有办法让算法不区分大小写?
【问题讨论】:
-
你可以在所有东西上使用
.upper吗?
标签: python case-insensitive fuzzy-search fuzzywuzzy