【发布时间】:2015-11-27 12:21:48
【问题描述】:
我正在为 java here 使用 HTML 解析器库。
由于文档较少,我遇到了一些问题,尽管我建议 HTML 解析器比 JSOUP 快速、容易出错的代码(Jsoup 实际上很容易使用,但很容易对你的代码感到恼火:()
- 是如何从 HTML 页面中提取元数据和描述 2.如何从 Parsed HTML 文档中专门获取单个标签元素
谢谢!
【问题讨论】:
-
你也试过 Tika 吗? tika.apache.org/1.2/parser.html
-
谢谢,但是我不想用那个
标签: java html-parsing