【发布时间】:2018-07-30 00:41:05
【问题描述】:
我正在使用 Jsoup 从 Godaddy 的网站中提取 html。我想在下面提取这个特定的部分。我有最终网页的特定部分,其中显示“抱歉,google.com 已被占用”和 HTML 代码本身。
但是在我的程序中,我有以下内容:
import java.io.IOException;
导入 org.jsoup.Jsoup;
import org.jsoup.nodes.Document;
import org.jsoup.nodes.Element;
import org.jsoup.select.Elements;
public class test {
public static void main(String[] args) throws IOException {
String url = "https://www.godaddy.com/dpp/find?checkAvail=1&tmskey=&domainToCheck=google";
Document document = Jsoup.connect(url).get();
Element div = document.getElementById("searchResults");
Elements spans = div.select("span");
for (Element e: spans)
System.out.println(e.text());
}
}
但是,此代码会打印 NullPointerException。我知道 JSoup 不能与 JS 一起使用,但这是 HTML 并且由于某种原因它没有被提取。我还尝试从页面中提取所有 HTML,它不包含这些单词。
谁能指出我正确的方向或给我另一种方法来从 godaddy 提取这条信息?
【问题讨论】:
-
使用 Godaddy API - developer.godaddy.com
-
@PedroLobito 非常感谢。