【发布时间】:2018-05-08 11:01:45
【问题描述】:
假设我想解析页面中所有 href 中的文本,但我的代码似乎不起作用。 我要解析的html文档中有一些sn-ps这样的代码。
<td class="alt1" id="ID" title="SOMETEXT">
<div>
<a href="THETEXTIWANT.html" id="SOME IDENTIFIER">SOME TEXT.</a>
</div>
</td>
这是我要运行的代码
from bs4 import BeautifulSoup,
for td in parse.find_all(class_="alt1"):
a = str(div.get())
f.writelines(a + '\n')
【问题讨论】:
-
[tag.text for tag in soup.find_all(href=True)]?
标签: python beautifulsoup html-parsing