【发布时间】:2016-10-30 10:01:01
【问题描述】:
我想写一小段代码,用jsoup从href中提取“类别”。
<a href="/wiki/Kategorie:Herrscher_des_Mittelalters" title="Kategorie:Herrscher des Mittelalters">Herrscher des Mittelalters</a>
在这种情况下,我正在搜索Herrscher des Mittelalters。
我的代码读取带有 BufferedReader 的 .txt 文件的第一行。
BufferedReader r = new BufferedReader(new InputStreamReader(new FileInputStream(new File(FilePath)), Charset.forName("UTF-8")));
Document doc = Jsoup.parse(r.readLine());
Element elem = doc;
我知道有获取 href-link 的命令,但我不知道在 href-link 中搜索元素的命令。
有什么建议吗?
附加信息:我的 .txt 文件包含完整的 Wikipedia HTML 页面。
【问题讨论】:
-
对不起,我对 HTML 了解不多。 id是什么意思?
-
没有问题,看看我下面的代码