【发布时间】:2016-04-23 14:17:36
【问题描述】:
我正在使用 Jsoup 从网页中检索详细信息并写入文本文件。我可以只检索其中的一部分吗?例如在以下链接中,我只想获取职位描述。
有时职位发布来自不同的网站,因此 html 标签的格式可能会有所不同。我需要一种仅检索职位描述的方法。以下代码检索网页上的所有内容。我怎样才能只得到职位描述?请帮忙。
public class MainCollector {
public static void main(String[] args) {
// TODO Auto-generated method stub
Document doc;
try {
doc = Jsoup.connect("http://aldogroup.luceosolutions.com/recruit/stores/advert_details.php?id=3136&_lang=en&partner_id=139").get();
String title = doc.title();
String body = doc.body().toString();
Document convertText = Jsoup.parseBodyFragment(body);
String convertedText = convertText.text();
System.out.println("Title:" + title);
System.out.println("Body:" + convertedText);
} catch (IOException e) {
// TODO Auto-generated catch block
e.printStackTrace();
}
}
}
【问题讨论】:
标签: java html web-scraping jsoup webpage