【发布时间】:2011-10-31 19:32:42
【问题描述】:
Jsoup 有 2 个 html parse() 方法:
- parse(String html) - “由于没有指定基本 URI,所以绝对 URL 检测依赖于包含标签的 HTML。”
- parse(String html, String baseUri) - "HTML 所在的 URL 从中检索。用于将相对 URL 解析为绝对 URL, 发生在 HTML 声明标签之前。”
我很难理解两者之间差异的含义:
- 在第二个
parse()版本中,“将相对 URL 解析为绝对 URL”是什么意思? 之前 HTML声明了一个<base href>标签”是什么意思?如果一个<base href>标签从不出现在页面中? - 绝对 URL 检测的目的是什么?为什么需要 Jsoup 找到绝对网址?
- 最后也是最重要的:
baseUri是HTML页面的完整URL吗 (如原始文档中所述)还是它的 base URL HTML 页面?
【问题讨论】:
标签: java html-parsing jsoup