【问题标题】:Make the Facebook crawler ignore the Canonical link让 Facebook 爬虫忽略规范链接
【发布时间】:2011-11-21 11:20:52
【问题描述】:

我想知道是否有办法让 Facebook 爬虫忽略页面上的规范链接。 我有一种情况,规范链接指向的 URL 与您实际所在的 URL 不同。 这导致页面中动态添加的og:image、og:url等被忽略,facebook页面上的信息完全错误。

我已经搜索了这个问题的答案,但没有找到答案......

【问题讨论】:

  • 你能发布代码或链接到你的页面
  • 不,很抱歉我不能发布代码,但问题是,如果您的 facebook 喜欢的页面上有规范链接,那么 facebook 使用的爬虫将使用该链接找到要抓取的“实际”页面。但问题是,由于 160 种语言的大约 80 个市场,此链接指向的页面与您实际所在的页面不同,因为我们不希望 Google 抓取所有语言。所以这导致我所有的 og:image、og:title 等都被忽略,因为它们在规范链接指向的页面上不存在。这些信息有用吗?
  • 并非如此。没有看到代码就无法调试。

标签: facebook-opengraph canonical-link


【解决方案1】:

如果我正确理解了您的 cmets,您可能会走错路。如果您希望您的赞按钮赞一个与您所在页面不同的网址,只需更改赞按钮的href。确保该 href 处的页面具有正确的 og 标签,并且您应该没有问题。

如果这不是您的意思,您能否尝试解释您想要实现的目标,而不是您认为的问题所在,因为您可能只是从错误的角度接近它。

【讨论】:

  • 据我了解,facebook 爬虫使用规范链接来找到正确的页面(如果使用了)。我遇到的问题是我没有让爬虫找到 og: -tags 我已添加到页眉中的元标记中。当我在 Facebook 调试器中调试页面时,爬虫会链接到规范链接指向的页面。
  • 我从 href 中获取了正确的 url,因为该 URL 是在 likebutton href 属性上指定的,但是找不到添加到元标记的图像和标题等。所以我得到了错误的图像等。
猜你喜欢
  • 1970-01-01
  • 2011-10-17
  • 2010-11-10
  • 1970-01-01
  • 2016-10-08
  • 2012-01-13
  • 1970-01-01
  • 2013-05-02
  • 1970-01-01
相关资源
最近更新 更多