【发布时间】:2022-01-04 16:19:36
【问题描述】:
我正在尝试找到正确的 XPath 表达式以仅从我的所有文档中获取 URL,无论标签是什么。我正在尝试这个:
<urlset xmlns="https://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://url
</loc>
<lastmod>2019-08-07T15:01:51+00:00
</lastmod>
</url>
</urlset>
下面的表达式给了我这些结果:
//*[contains(.,'http')]//text()
https://url2019-08-07T15:01:51+00:00
我正在寻找的是摆脱第二行。我需要能够从任何 XML 文件中获取仅 URL。
【问题讨论】: