【发布时间】:2019-11-28 01:07:28
【问题描述】:
我正在尝试从我的正确单词列表(如查找表)中找到拼写错误单词的匹配项。我有一个代码使用 leven(来源:wikipedia)相似度来比较 1 个单词与查找列表并选择最佳匹配(也通过定义成本)。
我的单词列表看起来像 correctList.txt:
words = ['computer','test','right','tesla','omega','energy']
基于 Levenshtein 相似性所需的两个输入,我提供以下输入:
userInput = 'compute'
limitSearch = int('3')
output = check(userInput, limitSearch)
for result in output:
print ('\n closeMatches: ', result)
现在我想扩展它,而不是使用查找字典检查一个拼写错误的单词,而是使用拼写错误的单词列表(类似于以下文件)并将其与我的正确 list.txt 进行比较并替换最好的匹配。
我的 mispelled.txt 示例:
misspelled = ['computee','teste','righ','tessla','oomega','energie']
如果您能提供帮助,那就太好了。
【问题讨论】:
标签: python dictionary similarity