【发布时间】:2019-04-25 02:58:22
【问题描述】:
我正在尝试使用 google chrome 扩展程序 webscraper.io 抓取网站的表格。在扩展的教程中,记录了如何抓取具有不同页面的网站,例如“第 1 页”、“第 2 页”和“第 3 页”,其中每个页面都直接链接在主页上。
然而,在website I am trying to scrape 的示例中,只有一个“下一步”按钮可以访问下一个站点。如果我按照教程中的步骤为“下一页”页面创建一个链接,它只会考虑第 1 页和第 2 页。为每个页面创建一个“下一个”链接是不可行的,因为它们太多了。如何让网络爬虫包含所有页面?有没有办法使用 webscraper 扩展来循环浏览页面?
我知道这可能是重复的:pagination Chrome web scraper。但是,它并没有得到很好的接受,并且没有包含有用的答案。
【问题讨论】:
标签: google-chrome pagination web-scraping