【发布时间】:2011-11-12 04:36:52
【问题描述】:
我需要在一堆 HTML 文件中找到所有位置,它们位于以下结构 (CSS) 中:
div.a ul.b
或 XPath:
//div[@class="a"]//div[@class="b"]
grep 在这里对我没有帮助。是否有一个命令行工具可以返回与此标准匹配的所有文件(以及可选的所有位置)?即,如果文件匹配某个 HTML 或 XML 结构,则返回文件名。
【问题讨论】:
-
你可能会喜欢 sed 并想出一些正则表达式来去除你不关心的元素;但这可能会很复杂并且不可重复使用,除非你在某处将其注销。我只想编写一个 perl 脚本,它使用 XML::Twig::XPath 之类的东西,并为所有带有您正在寻找的类属性的 xmls 打印一条带有文件名的消息。如果您有兴趣,我可以发布一个快速脚本作为答案;但是由于您特别要求命令行解决方案,所以我会推迟。
标签: html xml grep selector findinfiles