【发布时间】:2018-04-06 08:45:33
【问题描述】:
我在使用 Solr 进行搜索时遇到问题。 我索引了一些数据,然后尝试搜索文档。 在本文档中,我的字段名为:coord_address,其值为 "48 rue de la Frémondière" 如果我搜索 searchword: "48 rue de la Fremondiere",我会得到一个结果,searchword: "48 rue de la" 或 "La Fremondiere" strong> 我也有好的结果。
如果我通过删除 (le) 或 (48 rue la Fremondiere 错过了位于两个单词 (48 rue de Fremondiere) 之间的单词>) 删除 (de) 我没有结果。
有人可以帮助我。
这是我的 schema.xml
<field name="coord_adress" type="text" indexed="true" stored="true" multiValued="false" />
<fieldType name="text" class="solr.TextField" positionIncrementGap="100" autoGeneratePhraseQueries="false">
<analyzer type="index">
<!-- Remplace les apostrophes par des espaces pour le tokenizer -->
<charFilter class="solr.MappingCharFilterFactory" mapping="mapping-wordSeparators.txt"/>
<tokenizer class="solr.WhitespaceTokenizerFactory"/>
<filter class="solr.WordDelimiterFilterFactory" generateWordParts="1" generateNumberParts="1" catenateWords="0" catenateNumbers="1" catenateAll="0" preserveOriginal="1"/>
<filter class="solr.ASCIIFoldingFilterFactory"/>
<filter class="solr.LowerCaseFilterFactory"/>
<filter class="solr.EdgeNGramFilterFactory" minGramSize="2" maxGramSize="30"/>
</analyzer>
<analyzer type="query">
<!-- Remplace les apostrophes par des espaces pour le tokenizer -->
<charFilter class="solr.MappingCharFilterFactory" mapping="mapping-wordSeparators.txt"/>
<tokenizer class="solr.WhitespaceTokenizerFactory"/>
<filter class="solr.WordDelimiterFilterFactory" generateWordParts="1" generateNumberParts="1" catenateWords="1" catenateNumbers="1" catenateAll="0" preserveOriginal="1"/>
<filter class="solr.ASCIIFoldingFilterFactory"/>
<filter class="solr.LowerCaseFilterFactory"/>
</analyzer>
</fieldType>
什么我不明白,在界面分析中,我有匹配的术语但我的查询没有返回结果
【问题讨论】:
-
您使用的是哪个查询?只是术语查询或更复杂的东西?
-
我正在使用 solr Web 界面进行查询。我的请求是:http://localhost:8983/solr/adel_online/select? Indent = on & q = coord_adress: "48 rue de la Fremondiere" & wt = json 这个请求返回了一个很好的结果并且 http://localhost:8983/solr/adel_online/select? Indent = on & q = coord_address: "48 rue la Fremondiere" & wt = json 不返回任何结果,因为我删除了 (de)
标签: java search solr tokenize stop-words