【发布时间】:2015-10-10 14:47:25
【问题描述】:
当我手动尝试进入用户页面时,我试图从 facebook 上的用户那里获取 Facebook 源代码,它会为我提供所有数据。
html中这行代码好像有区别:
meta name="referrer" content="origin-when-crossorigin" id="meta_referrer"
当程序获得 html 时,给出的内容如下:
meta name="referrer" content="default" id="meta_referrer">
这是代码,我使用的是 Java 库 Jsoup
public void test() throws IOException {
String html = Jsoup.connect("https://www.facebook.com/*adduseridhere*").get().html();
System.out.println(html); }
所以我的问题是,我的程序是否可以像我的浏览器在收集 html 数据时一样运行?
【问题讨论】:
-
抓取他们的 HTML 源代码违反 Facebook 的 ToS。
标签: html facebook parsing html-parsing jsoup