【发布时间】:2015-07-14 08:07:22
【问题描述】:
我正在尝试使用以下代码从网页中抓取“工作月总收入中位数”:
class crawl_income(scrapy.Spider):
name = "salary"
allowed_domains = ["stats.mom.gov.sg"]
url = 'http://stats.mom.gov.sg/Pages/Income-Summary-Table.aspx'
def parse_data(self, response):
table_headers = response.xpath('//tr[@class="odd"]/td/td')
salary = []
for value in table_headers:
data = value.xpath('.//text()').extract()
salary.append(data)
print salary
process = CrawlerProcess()
process.crawl(crawl_income)
process.start()
但是当我试图打印出我为存储值而创建的列表时,我没有看到任何值。
我哪里做错了?
【问题讨论】:
标签: python web-crawler scrapy