【发布时间】:2011-08-30 16:03:10
【问题描述】:
我目前正在我的 Solr 架构中的文本字段上测试构面搜索,并注意到我在我的 stopwords.txt 文件中获得了大量结果。
我的架构当前使用文本数据类型的默认配置,我的印象是如果“solr.StopFilterFactory”过滤器正在使用,停用词不会被索引。
我希望有人能对此有所了解,或者 a) 帮助我理解为什么停用词不适用于构面以及如何使用它,或者 b) 为我指明正确的方向,这样我的构面查询就不会'不从停用词返回单词。
谢谢!
【问题讨论】:
-
你不应该在标记化的字段上分面
-
嗨,我有同样的问题/情况。我的“关键字”部分合并到一个字段中 - 示例“car/dog/red/be/at”下一个字段:“blue/green/yellow”等。所以我必须使用 tokenizner 将字符串分解为单词:。此外,我使用停用词列表来删除停用词(例如:at、be、...)但是停用词也被索引并存储,并将在 facetet 搜索中返回......使用 Sol 1.3 有什么解决方法吗?
标签: solr facet stop-words facets