【发布时间】:2015-09-04 18:59:08
【问题描述】:
我必须报告某个 css 类在我们页面内容中出现的次数(超过 10k 页)。问题是,页眉和页脚包含该类,因此 grep 会返回每一页。 (没用)
那么,我该如何获取内容呢?
我在每个页面上都有 <!-- main content --> 和 <!-- end content --> 评论。
那么我如何 grep(我什至 grep 吗?)这些 cmets 之间的内容?
这是托管在 linux 服务器上的,我可以访问 Grep、Awk 和 Sed。
理想情况下,我会得到一份报告(.txt 或 .csv),其中包含显示类的页面和行号,但仅列出页面本身就足够了。
谢谢!
【问题讨论】:
-
使用this answer 的适当部分过滤到页面的那个部分,然后写下你在那个部分发生的其他匹配。