【发布时间】:2009-11-20 15:19:33
【问题描述】:
我正在学习 Scrapy 教程。为了测试这个过程,我用这些文件创建了一个新项目:
See my post in Scrapy group for links to scripts, I cannot post more than 1 link here.
爬虫运行良好,将title标签之间的文字刮掉,放到FirmItem中
[whitecase.com] INFO: Passed FirmItem(title=[u'White & Case LLP - Lawyers - Rachel B. Wagner '])
但我陷入了流水线过程。我想将此 FirmItem 添加到 csv 文件中,以便将其添加到数据库中。
我是 python 新手,我正在学习。如果有人给我一个关于如何使 pipelines.py 工作以便将抓取的数据放入 items.csv 的线索,我将不胜感激。
谢谢。
【问题讨论】:
标签: python web-crawler scrapy