【发布时间】:2013-05-06 15:39:10
【问题描述】:
我正在为我的项目浏览 Twitter 网页。发现了这个问题。
例如
网页:https://twitter.com/SrBachchan
页面来源(在浏览器中通过右键单击查看):
查看源代码:https://twitter.com/SrBachchan
通过 curl 命令下载源代码。下载的源代码(通过curl)与原始源代码不同。
我也尝试使用 python 下载源代码(使用 urllib2.urlopen)。和curl得到的一样。
任何人都可以对此有所了解吗?
【问题讨论】:
-
页面可以根据不同的用户代理采取不同的行动。
-
那么,获取确切源代码的过程是什么?
-
使用推特 API Twitter APIs。通过api可以下载用户的所有东西
-
我对 Twitter 比较陌生。您能否通过提及 twitter api 的名称来详细说明