【问题标题】:How to create a local Wikidata query service?如何创建本地维基数据查询服务?
【发布时间】:2018-01-01 04:10:28
【问题描述】:

我正在尝试在 Wikidata 上运行 SPARQL 查询,但它超时。我想下载一个dump 并在某个数据库中对其进行索引,这样我就可以使用 HTTP 请求运行本地 SPARQL 查询。我还需要支持 Wikidata 特定的扩展,例如 SERVICE wikibase:label。我已经下载了一个 RDF 转储。下一步是什么?

【问题讨论】:

  • 如果您想使用 SPARQL,为什么要下载 JSON 转储? SPARQL 是一种 RDF 查询语言。那么这是什么意思?确切地说,下载 RDF 转储并将其加载到三重存储中。
  • 这不是索取工具的正确地方,你应该知道这一点。
  • @AKSW 谢谢,我会下载 RDF 转储。我还将编辑该问题,因此它不是工具推荐。我认为任何三重存储都行不通,因为我需要支持特定于维基数据的扩展,例如 SERVICE wikibase:label,不是吗?
  • @dimid Wikidata 扩展确实不会在另一个 Triplestore 产品中可用(当有人决定扩展标准时这不是很有趣吗?)但是对于大多数这些功能的替代品,FWIW 都可以使用 是符合 SPARQL 标准的。
  • 如果我没记错的话,他们使用 Blazegraph - 但我认为这些扩展是 Wikidata 特定的,并且在“普通”Blazegraph 发行版中不可用。不过我可能错了。

标签: sparql rdf dump wikidata


【解决方案1】:

Wikimedia has documentation 关于如何从他们的转储之一运行您自己的 SPARQL 端点。他们还有一个更新程序,可以从他们的服务器流式传输更新,以使您的端点保持最新。

您不需要做任何特别的事情来支持他们的扩展,它默认包含在内。

我建议在生产环境中使用带有 http auth 的反向代理(如 nginx 或 apache),默认情况下可以访问管理仪表板。

【讨论】:

  • 谢谢!如何将查询超时时间增加到60秒以上,我尝试在RWStore.properties中查找,但没有找到这样的设置。也许我错过了什么。
  • @dimid 你知道如何延长超时时间吗?
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2011-07-28
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多