【发布时间】:2016-09-27 13:25:12
【问题描述】:
我正在尝试从网页中抓取一些信息。我的问题是我得到的回报不包含我正在寻找的东西。
如果我检查网络的源代码,我会发现一个空白部分
<section id="player-controller">
</section>
但如果我检查我想要从中获取数据的元素,它们会出现在该部分中
由于它是动态生成的,我尝试使用 HTMLUnit,但仍然无法获得它。也许我看错了。
有什么方法可以使用 HTMLUnit 获取代码,还是应该使用其他工具?
已解决
通过使用 HTMLUnit 并在打印页面之前让进程停止一段时间,我得到它来打印丢失的内容
WebClient webclient = new WebClient();
HtmlPage currentPage = webclient.getPage("https://www.dubtrack.fm/join/chilloutroom");
Thread.sleep(2000);
System.out.println(currentPage.asXml());
【问题讨论】:
标签: java web-scraping htmlunit