【发布时间】:2012-08-22 17:44:38
【问题描述】:
假设html网页是这样的:
<html>
<div id="a">
<div class="aa">
<p>
<a id="ff" href="#">ff</a>
<a id="gg" href="#">gg</a>
</p>
</div>
<div class="bb">
<p>
<a id="ff" href="#">ff</a>
</p>
</div>
</div>
<div id="b">
</div>
</html>
使用后
soup = BeautifulSoup(webpage.read())
我有 html 网页,我想获取树结构下的链接:<html> -> <div id="a"> -> <div class="aa">。
如何使用 Beautiful Soup 编写以下 Python 代码?
【问题讨论】:
-
如果您提及您到目前为止所尝试的内容,将会很有用。
标签: python beautifulsoup web-crawler