【发布时间】:2020-08-31 18:18:22
【问题描述】:
我正在从一个包含多页数据的网站中抓取信息。在每次抓取中,我都提取了一些信息。但是,我还想进入我正在抓取的内容的链接并从那里抓取信息,然后返回该站点并继续抓取。我将如何使用 Scrapy 做到这一点?
【问题讨论】:
-
嗨,悲伤的蟾蜍,您能否向我们展示您已经尝试过的内容以及您尝试抓取的网站?请更新您的问题,以便人们可以帮助您。
-
让我们调用页面有结果列表index_page;让我们调用页面有详细数据detail_page,所以你想从index_page中提取detail_page url,然后你想去detail_page抓取详细数据?你不知道怎么通过scrapy去detail_page?
-
如果您想从主页和详细信息页面获取数据以创建一行数据,则可以使用
Request(url_to_details, meta={"data":data_from_main_page}, parse_details})。但是您不想从许多页面中创建一行然后您要求知识,您可以在任何教程或文档中找到这些知识,而您只会浪费时间询问它。
标签: python html web web-scraping scrapy