【发布时间】:2013-09-14 06:46:24
【问题描述】:
from scrapy.spider import BaseSpider
class dmozSpider(BaseSpider):
name = "dmoz"
allowed_domains = ["dmoz.org"]
start_urls = [
"http://www.dmoz.org/Computers/Programming/Languages/Python/Books/",
"http://www.dmoz.org/Computers/Programming/Languages/Python/Resources/"
]
def parse(self, response):
filename = response.url.split("/")[-2]
open(filename, 'wb').write(response.body)
然后我运行“scrapy crawl dmoz” 然后我得到了这个错误:
2013-09-14 13:20:56+0700 [dmoz] 调试:重试 http://www.dmoz.org/Computers/Programming/Languages/Python/Resources/> (失败 1 次):与另一端的连接在非清洁中丢失 时尚。
有谁知道如何解决这个问题?
【问题讨论】:
-
听起来像是网络服务器或连接问题。你在这里无能为力。请稍后再试。