【发布时间】:2014-05-04 09:13:22
【问题描述】:
我已经构建了一个摘要程序,该程序利用解析器一次解析多个网站。我在每篇文章中只提取<p>。
这会抛出很多与文章无关的随机内容。我见过几个可以完美解析任何文章的人。我该怎么做?我正在使用美丽的汤
【问题讨论】:
-
内容不必在
p标签中,那么您为什么希望它起作用呢?也许您可以参考您尝试定位的网站? -
您的问题措辞不当。请重新阅读并编辑您的问题。
标签: python parsing html-parsing beautifulsoup