【问题标题】:YQL XPath from a Yahoo Pipes Feed来自 Yahoo Pipes 提要的 YQL XPath
【发布时间】:2012-01-01 02:05:02
【问题描述】:

我有这种情况,我需要从网页中获取一些数据,我正试图用 Yahoo Pipes 抓取它以制作一个快速原型。我用“Fetch Page”划分数据,然后将 YQL 查询添加到“Loop”,这样我就可以从“Fetch Page”模块浏览每个结果并提取我需要的数据,同时保留来自“Fetch”的分组页面”模块。

当我向 YQL 查询添加 XPath 以请求 URL 时,它总是会发送错误。

所以我的问题是,是否可以让 XPath 处理来自循环的提要?

【问题讨论】:

  • 如果您可以分享指向您正在处理的 Pipe 的链接(或说明问题的最小示例),那么有人可能更能帮助调试它。

标签: loops xpath web-scraping yql yahoo-pipes


【解决方案1】:

使用存储在您的域中的 CSV 文件粘贴来自 fetch page 模块的分组。在 Yahoo Pipes 中使用循环查询 CSV 文件以获取数据:

select * from html where url in (select col0 from csv where url="http://abdefg/foo.csv") and xpath="//title"

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2012-04-13
    • 1970-01-01
    相关资源
    最近更新 更多