【发布时间】:2012-02-21 05:18:27
【问题描述】:
我正在开发一个 ROR 应用程序,在该应用程序中我需要实现一个爬虫,该爬虫可以爬取其他站点并将数据存储在我的数据库中。例如,假设我想从http://www.snapdeal.com 抓取所有交易并将它们存储到我的数据库中。如何使用爬虫实现这一点?
【问题讨论】:
-
就像任何其他语言一样。获取一些 HTML,解析它,跟踪链接,将所有内容存储在数据库中。
-
你可以试试pioneer gem,虽然它还在开发中
标签: ruby-on-rails ruby web-crawler