【问题标题】:How to fetch data from Wikipedia table using dbpedia SPARQL如何使用 dbpedia SPARQL 从 Wikipedia 表中获取数据
【发布时间】:2017-07-13 16:47:56
【问题描述】:

我能够执行查询,例如查找国家/地区的资本或货币,但在获取表数据时遇到问题。我想从this 页面的表中提取数据。对应的dbpedia页面是this。

现在,如果您查看 dbpedia 页面,我可以查询的表格数据没有关系。我在这里错过了什么?

编辑:有一个project,我猜它目前正在开发中。除了刮痧还有别的办法吗

【问题讨论】:

  • 看起来这还不是一个完全解决的问题。除了您共享的项目之外,还有papers written on it。如果您的要求是一次性的,您应该能够抓取原始表数据,甚至可以从中创建三元组(关系的设计会很有趣——我已经作为实体存在于 DBPedia 上的状态)
  • 对,这是正在进行的开发,总的来说,正在进行的研究。一般来说,可以使用任何 csv2rdf 工具并手动完成,但自动完成并不是那么简单。作为 GSOC 2017 的一部分,您可以试用当前工作中的工具:github.com/dbpedia/table-extractor 但是这必须加载到您自己的三重存储中。

标签: sparql rdf semantic-web dbpedia


【解决方案1】:

这个答案可能不会马上帮助你,但我认为它应该是这样工作的。
与其“查询表”,不如这样想:
您正在寻找所有印度州(每个州都是 DBPedia 上的实体)、它们的 GDP 和可能的其他属性。
GDP 是(或应该)国家实体的一个属性——“列表”页面只是一个方便的聚合,不应该作为主副本。

类似:

select ?state ?gdp WHERE {
  ?state dbo:country dbr:India .
  ?state ?hasGDP ?gdp 
} 
ORDER by ?gdp

遗憾的是,DBPedia 上的状态页面目前没有 ?hasDGP 属性(在类似的行上,因为它们有 dbo:populationTotal 属性)。

由于缺少这些链接,您可能会重新使用抓取作为替代方案。

【讨论】:

    猜你喜欢
    • 2018-11-20
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2016-11-06
    • 1970-01-01
    • 2011-03-19
    • 2012-11-26
    • 2014-03-17
    相关资源
    最近更新 更多