【发布时间】:2010-06-24 03:10:03
【问题描述】:
我一直在研究寻找有效的解决方案。我研究了不同的引擎(谷歌的 diff-match-patch,python 的 diff)和一些最长的通用链算法。
我希望得到你们关于如何解决这个问题的建议。您特别想推荐任何算法或库?
【问题讨论】:
-
看来您已经回答了自己的问题。如果您正在查看“最长公共子序列”和“差异”,您就会知道这是一个经典问题并且是 NP 难题。这里没有人会比几代计算机科学家做得更好。 en.wikipedia.org/wiki/Longest_common_subsequence_problem
-
DNA [精确] 匹配springerlink.com/content/k2uq2r0037105466 怎么样?
-
你想要什么,“百分比差异”(如何定义?)或“最长的共同点”(可能 == 子字符串;“链”???)或两者兼而有之(它们不是相同的)?举个例子,例如s1 = "thequickbrownfox", s2 = "thequickvrownfox",你期望什么输出?你会把结果用来做什么?你做了什么研究,到目前为止你得出了什么结论?这是作业吗?
-
@john s1 = "thequickbrownfox" s2 = "thequickbrownfoxes" 输出,相似度 = 98%(差异 = 2%)不,这不是硬件,我正在努力将其集成到一个维基。
-
@colorful:如何通过在 16 个字符的字符串中添加 2 个字符来获得差异 = 2%?我再次问:您如何定义百分比差异?如果您需要帮助而不是闲逛,请回答其他问题。