【问题标题】:Comparison: DB Full Text search to Search engine (Lucene)比较:数据库全文搜索到搜索引擎(Lucene)
【发布时间】:2010-09-22 21:16:00
【问题描述】:

从 stackoveflow.com 的角度来看(由 2-3 名工程师组成的团队构建一个旨在扩展的网站项目)在开发过程的早期花费精力来构建基于 Lucene/Autonomy 的搜索是否有意义……而不是基于数据库的全文搜索。

优点/缺点:
使用成熟的 Lucene 实现(如 nutch 或自治),在后期迁移到 Lucene(这是不可避免的)的成本可以忽略不计。
大量添加额外的索引服务器(比如使用 nutch)来维护不断增长的搜索索引相对容易。
对于 Lucene 实现,我很可能需要一个额外的服务器来维护内存中的索引(在扩展过程的早期阶段)。

【问题讨论】:

    标签: database full-text-search lucene scaling


    【解决方案1】:

    但你应该保持隔离 - 如果你知道你将用搜索引擎查询替换它们,不要开始在你的代码中抛出 SELECTS。用一个薄抽象层包裹您的数据库的全文搜索,确保您不会在不应该使用的地方使用数据库功能。

    我支持接受的答案 - 这里过早优化绝对是邪恶的。

    【讨论】:

      【解决方案2】:

      数据库全文搜索性能因数据库而异,但它是迄今为止最简单的设置选项。因此,从它开始,如果证明太慢,则转向 lucene 或 sphinx。

      【讨论】:

      • 如果你的 db 的全文搜索足够好,就使用它(除非你有特殊的需求,比如 db-independence)。
      猜你喜欢
      • 2011-06-06
      • 1970-01-01
      • 2017-07-23
      • 2010-11-26
      • 1970-01-01
      • 2013-09-28
      • 2012-01-31
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多