【发布时间】:2018-02-27 09:02:03
【问题描述】:
我已将 Apache Solr 6.6.2 配置为稍后索引和搜索文档。我面临一些问题。如果文档中有一个数字,例如 1234,我希望它应该映射(复制)到相应的乌尔都语数字,例如 1234。如果用户输入 1234 或 1234,最终将有助于检索文档。 Solr 中是否有任何内置解决方案或如何使用此功能?
【问题讨论】:
标签: java apache solr lucene tokenize
我已将 Apache Solr 6.6.2 配置为稍后索引和搜索文档。我面临一些问题。如果文档中有一个数字,例如 1234,我希望它应该映射(复制)到相应的乌尔都语数字,例如 1234。如果用户输入 1234 或 1234,最终将有助于检索文档。 Solr 中是否有任何内置解决方案或如何使用此功能?
【问题讨论】:
标签: java apache solr lucene tokenize
如果您使用 Java/SolrJ 客户端进行索引...
将 junidecode 依赖添加到您的项目中
毕业典礼
compile group: 'junidecode', name: 'junidecode', version: '0.1.1'
对于 Maven:
<dependency>
<groupId>junidecode</groupId>
<artifactId>junidecode</artifactId>
<version>0.1.1</version>
</dependency>
索引时...索引一个附加字段...
import net.sf.junidecode.Junidecode;
String converted = Junidecode.unidecode("۱۲۳۴")
// converted == 1234
【讨论】: