【发布时间】:2013-07-29 03:29:10
【问题描述】:
我目前正在创建一个脚本,它将强制我的访问者在下载 3 个文件后注册/登录。我打算使用 cookie 来跟踪下载次数。
此外,我想防止来自不良网络爬虫的内容农场。我不知道网络爬虫是否也可以像普通访问者一样存储cookie,这样我也可以阻止他们下载我的文件超过3次。
如果不支持 cookie 的网络爬虫仍然可以下载我的文件 3 次以上,有没有其他方法可以跟踪他们的访问次数?
【问题讨论】:
-
爬虫一般不存储cookies,你可以利用captchas来降低不良爬虫的下载率,或者干脆使用Javascript,爬虫避开java
-
依赖爬虫
-
感谢您的回复。那么,还有其他方法可以追踪它们吗?通过 IP 地址跟踪它们将要求所有共享互联网连接的访问者在检测到其中 1 个已下载超过 3 次的访问者后进行注册。
标签: php web-crawler