【发布时间】:2012-10-01 10:18:59
【问题描述】:
这个tutorial 帮助我收集了网站上的第一个下拉列表条目。 但是我无法使用 Scrapy 获取第二个条件/依赖下拉框的数据。
假设以下过程是要走的路,那么第 2 步如何工作?到目前为止,这些值从未出现过......
- 获取第一个下拉框的列表条目
- 选择第一个下拉框的第一个值。
- 获取所有相关的下拉值。
- 遍历第一个下拉列表...
我认为下面的代码需要调整,因为代码是提交表单的:
for i in range(len(brandCategoryList)):
# Generate new request for each brand category's page
yield FormRequest("http://www.xxxxxxxxxx.com",
method='POST',
formdata={'BrandName':'','CatBrand':brandCategoryList[i],'submit1':'Find+Product'},
callback=self.parseBrandPage,
meta={'brandCategoryId':i,'brandCategoryName':brandCategoryList[i]})
谢谢
【问题讨论】:
标签: python web-crawler scrapy