【发布时间】:2013-01-28 08:11:32
【问题描述】:
我有一个包含大约 500M 个文档的 Lucene (4.1) 索引。我尝试在其上构建搜索界面,但遇到了一些性能问题。
最初,我使用MatchAllDocumentsQuery 显示所有命中(分页)。此搜索需要很长时间(大约 10 秒)。我认为这是因为我使用的收集器,它试图找到点击总数TotalHitCountCollector。
我希望能够对查询进行时间限制,所以我找到了TimeLimitingCollector。不幸的是,API 文档有点阴暗。它使用了一个没有太多记录的计数器。
有人有在 Lucene 4.x 中使用 TimeLimitingCollector 的经验吗?如果是这样,是否有方法可以估计点击总数?
我阅读了:https://builds.apache.org/job/Lucene-Artifacts-4.x/javadoc/core/org/apache/lucene/search/TimeLimitingCollector.html 和示例,但不清楚设置 Counter 以及如何将其与 numTicks 结合使用
【问题讨论】:
标签: performance lucene