【发布时间】:2020-02-11 04:07:05
【问题描述】:
使用 beautifulsoup,我有一些这样的 HTML 变量:
<head>....<\head>
<body>
<h2> my title <\h2>
<p> text text text <\p>
<p> text2 text2 <\p>
<h2> my title 2<\h2>
<p> text text text <\p>
我想提取每一个和下一个
标签。
我想得到的例子:
First = " 我的标题
文字文字文字
text2 text2 "
第二个 = " 我的标题
文字文字文字"
知道每个文档中的个数和
标签是可变的。
任何人都可以提出解决此问题的方法或方法吗?
【问题讨论】:
标签: python python-3.x web-scraping beautifulsoup html-parser