【问题标题】:seo toolkit - request is disallowed by a robots.txt ruleseo 工具包 - robots.txt 规则不允许请求
【发布时间】:2016-03-25 00:07:23
【问题描述】:

我正在尝试在我正在运行的应用程序上运行 SEO 工具包 IIS 扩展,但我不断收到以下错误:

Robots.txt 规则不允许该请求

现在我已经在应用程序和根网站中编辑了 robots.txt 文件,因此它们都具有以下规则:

User-agent: *
Allow: /

但这没有任何区别,工具包仍然无法运行。

我什至尝试删除两个 robots.txt 文件,但仍然没有任何区别。

有谁知道 seo 工具包无法运行的任何其他原因或如何解决此问题?

【问题讨论】:

  • 哪个 url 触发了这个违规行为?你的子文件夹中有 robots.txt 吗?
  • 应用程序的 url - 我拥有(或删除)的唯一 robots.txt 文件位于根文件夹(主站点)和应用程序文件夹 - 子站点

标签: iis seo


【解决方案1】:

基本上,robots.text 是一个不允许 Google 抓取管理员不允许的页面的文件,因此 Google 会忽略这些页面,这就是为什么这些页面永远不会排名并且 Google 永远不会显示该数据的原因。

【讨论】:

  • 这不能回答问题。
【解决方案2】:

robot.txt 可能已被缓存。停止/重新启动/卸载 IIS(应用程序)。 robots.txt 将刷新。打开浏览器重新加载文件。您甚至可以删除该文件以确保 IIS 没有缓存它。

【讨论】:

  • 嗨,我已经尝试了所有这些但没有成功 - 某些东西仍然导致违规发生
【解决方案3】:
  1. 检查以确保 DNS 记录指向正确的服务器
  2. 如果您要搜索文件,请注意区分大小写 - robots.txt 与 Robots.txt
  3. 验证 Toolkit 是否确实在尝试访问该站点。检查 IIS 日志中是否存在“iisbot”用户代理。

【讨论】:

  • 也尝试了所有这些都没有成功,并且 iis-bot 出现在日志中
【解决方案4】:

要允许所有机器人完全访问,我建议使用以下语法(根据robotstxt.org

User-agent: *
Disallow:

(或者只是创建一个空的“/robots.txt”文件,或者根本不使用)

allow directive 仅受“一些主要爬虫”支持。所以也许 IIS 搜索引擎优化 (SEO) 工具包的爬虫没有。

希望这会有所帮助。如果没有,您也可以尝试通过 IIS SEO Toolkit 的Managing Robots.txt and Sitemap Files learning resource

【讨论】:

  • 这也没什么区别 - 它与我上面应用的允许所有规则相同,并且如问题中所述,我已经尝试删除文件
猜你喜欢
  • 2016-09-16
  • 2017-04-01
  • 2023-04-07
  • 2013-09-20
  • 2020-07-01
  • 1970-01-01
  • 1970-01-01
  • 2019-04-10
  • 1970-01-01
相关资源
最近更新 更多