【发布时间】:2020-10-09 13:53:21
【问题描述】:
我正在开发一个使用 Elasticsearch 执行多语言全文搜索的项目。我使用的历史训练数据集也是多语言的,我现在正在尝试使用语言分析器和语言检测来配置文本分析。
1) 我使用以下链接作为指南,正如第一段中所写,我需要安装 推理摄取处理器。我该如何安装它? (我不熟悉 Java 和 elasticsearch 的新手) https://www.elastic.co/de/blog/multilingual-search-using-language-identification-in-elasticsearch
2) Elasticsearch 为多种语言提供语言分析器,如果我点击此链接https://www.elastic.co/guide/en/elasticsearch/reference/current/analysis-lang-analyzer.html,我将需要以 8 种语言配置分析器,我将不得不创建 8 个不同的自定义分析器,这很长。有没有更短的方法可以为 8 种语言编写一个设置?
【问题讨论】:
标签: java elasticsearch nlp lucene