【发布时间】:2013-04-28 17:27:03
【问题描述】:
我刚刚开始在 Python 中使用 Scraperwiki 进行抓取。已经想出了如何从页面中抓取表格,每月运行抓取器并将结果彼此重叠保存。很酷。
现在我想scrape this page 提供有关 Android 版本的信息并每月运行脚本。特别是,我想要版本、代号、API 和分发的表格。这并不容易。
使用包装器 div 调用该表。有什么办法可以抓取这些信息吗?我找不到任何解决方案。
B 计划是抓取可视化。我最终需要的是代号和百分比,这样就足够了。可以在 Google 图表脚本的 HTML 中找到此信息。
但我无法使用我的“souped”HTML 找到此信息。我有a public scraper over here。您可以对其进行编辑以使其正常工作。
谁能解释我如何解决这个问题?一个带有 cmets 的工作刮板会很棒。
【问题讨论】:
标签: python web-scraping scraperwiki