【问题标题】:SOLR: Get Full Text Content for document that matches querySOLR:获取与查询匹配的文档的全文内容
【发布时间】:2020-08-27 05:54:25
【问题描述】:

我有一个 SOLR 实例,并希望提取在实例中索引的全文内容。这可能吗?

如果有我可以用来从实例中获取全文内容的查询类型,如果有人能指出我将不胜感激!

【问题讨论】:

  • 这看起来很有希望:stackoverflow.com/questions/4948587/…
  • 您是否正在索引文档(如 PDF、docx 等),或者您如何将数据导入 Solr?如果您自己提交,唯一的要求是该字段设置为stored="true",并且您在检索文档时将其包含在字段列表中(fl 参数)。
  • 哈哈,我刚学会了!我的架构有stored="false",所以我认为此内容不可检索...

标签: apache solr lucene


【解决方案1】:

事实证明,SOLR 模式必须在存储全文的字段上指定stored="true",以便查询获取该字段中的所有内容。

我的架构指定了相反的内容,这意味着该文本可以大量检索(尽管它是可搜索的,因为架构指定了index="true"

【讨论】:

  • 快速提问。当您说 stored="false" 时,数据会去哪里?完全可以搜索吗?附在文件上?还是仅当您在该字段上设置了 indexed="true" 时?
  • 查看这些文档:solr.apache.org/guide/6_6/defining-fields.html。简而言之,stored=false 和 index=true 不会存储原始文本内容,例如显示目的,它只是为例如建立索引搜索目的。例如,如果您只想知道包含“rabbit in hat”的文档 ID,那么 stored=false 会很有用。我不确定为什么要使用 stored=false and index=false
猜你喜欢
  • 1970-01-01
  • 2021-12-06
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2017-06-17
  • 2019-05-06
  • 1970-01-01
相关资源
最近更新 更多