【发布时间】:2016-04-15 17:14:02
【问题描述】:
我正在编写一个分析工具,用于计算源代码中有多少孩子有任何 HTML 标记。
我用 BeautifulSoup 映射了代码,现在我想遍历页面中的任何标签并计算它有多少孩子。
迭代所有标签的最佳方法是什么?例如,我怎样才能获取所有没有孩子的标签?
【问题讨论】:
-
您能给我们举一个您的 HTML 源代码以及您已经尝试过的示例吗?
-
建议:找到所有没有子标签(“叶子”)的标签,然后按照自己的方式备份。
-
我可以比较两种汤的标签吗?
标签: python python-2.7 beautifulsoup html-parsing