【问题标题】:Block webcrawler/bot AWS elastic bean stalk阻止网络爬虫/机器人 AWS 弹性豆茎
【发布时间】:2014-03-30 05:45:31
【问题描述】:

以下机器人一直在攻击我的应用程序,我想知道如何使用 AWS 在防火墙处阻止它。看起来好像您能够包括访问但不能阻止访问。有人知道怎么做吗?

w00tw00t.at.blackhats.romanian.anti-sec:

【问题讨论】:

    标签: amazon-web-services amazon-elastic-beanstalk ec2-ami


    【解决方案1】:

    究竟是怎样的攻击? HTTP?您在使用负载均衡器吗?

    这里有一些选项:

    1. 您通过 ssh 连接到 Elastic Beanstalk 机器正在使用的机器,并获取该请求来自的 IP 地址。查看/var/app/current/log。然后在 AWS 安全组上屏蔽该 IP 地址。

    2. 如果它是一个爬虫,您可以考虑为您的应用程序创建一个 robots.txt 文件。更多信息在这里:http://en.wikipedia.org/wiki/Robots.txt 或类似的东西:

      User-agent: * # match all bots
      Disallow: / # keep them out
      

    【讨论】:

    • Rico 的日志路径似乎不正确,你知道它是否改变了吗?另外,您是否知道 .txt 文件将放置在 maven 应用中的什么位置?
    • /var/app/current/log 是 Rails 应用程序的路径,因为您正在运行 java 查看 /var/app 或运行 ps -Af 并尝试确定 java 的根目录在哪里应用程序是。您是否从 ElasticBeanstalk 运行 Tomcat 堆栈?如果是,您通常将 robots.txt 放在Tomcat_DIR/webapps/ROOT/
    猜你喜欢
    • 2018-02-25
    • 2017-09-01
    • 2019-04-21
    • 2014-12-22
    • 1970-01-01
    • 2016-09-08
    • 1970-01-01
    • 1970-01-01
    • 2015-03-20
    相关资源
    最近更新 更多