【问题标题】:Web Page and its Downloaded Source Code are Different . Strange but True.!网页和它下载的源代码是不同的。奇怪但真实。!
【发布时间】:2013-05-06 15:39:10
【问题描述】:

我正在为我的项目浏览 Twitter 网页。发现了这个问题。
例如
网页:https://twitter.com/SrBachchan
页面来源(在浏览器中通过右键单击查看):
查看源代码:https://twitter.com/SrBachchan

通过 curl 命令下载源代码。下载的源代码(通过curl)与原始源代码不同。

我也尝试使用 python 下载源代码(使用 urllib2.urlopen)。和curl得到的一样。

任何人都可以对此有所了解吗?

【问题讨论】:

  • 页面可以根据不同的用户代理采取不同的行动。
  • 那么,获取确切源代码的过程是什么?
  • 使用推特 API Twitter APIs。通过api可以下载用户的所有东西
  • 我对 Twitter 比较陌生。您能否通过提及 twitter api 的名称来详细说明

标签: twitter web


【解决方案1】:

我自己找到了解决方案。 需要添加标题'--header "Accept-Language: en"' 以获得该语言的确切源代码。

例如curl --header "Accept-Language: en" https://twitter.com/SrBachchan 可以完成这项工作。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2017-09-23
    • 2016-05-12
    • 2013-01-24
    • 2013-11-26
    • 1970-01-01
    相关资源
    最近更新 更多