【发布时间】:2017-03-03 23:02:40
【问题描述】:
在下面的页面上 --> link,我正在尝试使用BeautifulSoup 来提取最底部的<a> 文本,即'Private Life' 和'Lost Boy'。
但我很难抓取<iframe> 的内容。
我了解到它需要来自浏览器的不同请求。
所以我试过了:
iframexx = soup.find_all('iframe')
for iframe in iframexx:
try:
response = urllib2.urlopen(iframe)
results = BeautifulSoup(response)
print results
但返回None。
如何解析下面的 html,以便获取每个 a['href'].get_text()?
【问题讨论】:
标签: python html iframe beautifulsoup