【发布时间】:2018-12-27 08:17:52
【问题描述】:
今天我使用 beautifulsoup4 抓取了一个网站,并尝试在该网站上获取大约 16.000 条数据。 就在那之后的几分钟,那个网站就宕机了,大约几个小时就无法访问了。 所以..我的问题是:
网页抓取只会对拥有网站的人造成伤害吗?
【问题讨论】:
-
想象网站所有者是你,你的感受如何?
-
与 DDoS @ewwink.. 的效果一样吗?
-
如果你做得太快,是的,几乎一样。
-
基于意见的问题不属于这里。但是考虑一下,谷歌在抓取网站时会伤害它们吗?如果它遵循 robots.txt 则不是
标签: web-scraping server beautifulsoup scrapy scrape