【发布时间】:2015-06-18 18:33:37
【问题描述】:
我正在使用 Jsoup 来解析一些网页检索到的页面。 由于某些原因,Jsoup 在尝试解析 http://higherperspectives.com/keanu-reeves-life/ 的内容时进入了无限循环
这里是使用的代码:
Document document = Jsoup.connect(searchResult.get("link"))
.timeout(500).followRedirects(false).validateTLSCertificates(false)
.userAgent("Mozilla/5.0 (Windows NT 6.2) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/30.0.1599.69 Safari/537.36")
.maxBodySize(0).get();
Elements classElements = document.select("*:containsOwn(${owlSearchTerm.get("class")})");
Elements relationElements = document.select("*:containsOwn(${owlSearchTerm.get("relation")})");
Elements individualElements = document.select("*:containsOwn(${owlSearchTerm.get("individual")})");
connect 方法永远不会结束。连接建立成功,但我猜Jsoup创建Document对象时会出现问题。
有没有办法跳过这种情况?
【问题讨论】:
标签: java html-parsing jsoup