【发布时间】:2012-09-21 07:26:08
【问题描述】:
我在 stackoverflow 和 Google 中进行了很多搜索,但没有找到最佳答案。 实际上,我打算开发一个新闻阅读器系统,从网络(使用爬虫)爬取和收集新闻,然后,我想在网站中找到相似或相关的新闻(为了防止在网站上显示重复的新闻)
我认为最好的活生生的例子是谷歌新闻,它从网络上收集新闻,然后分类和查找相关的新闻和文章。这就是我想做的。
执行此操作的最佳算法是什么?
【问题讨论】:
-
在我看来,您可以使用贝叶斯网络,但一个好的网络并不是那么容易实现。
标签: nlp artificial-intelligence similarity