【发布时间】:2020-12-10 16:54:45
【问题描述】:
您好,我正在尝试抓取以下页面:
https://www.imdb.com/chart/top
我想获取当您将鼠标悬停在任何电影名称上时显示的所有导演姓名:
这就是我所做的:
direc = requests.get(imdb).content
direc_b = BeautifulSoup(direc, 'lxml')
direc_b_t = direc_b.find_all(class_= "titleColumn")
我得到的结果如下:
<td class="titleColumn">
1.
<a href="/title/tt0111161/" title="Frank Darabont (dir.), Tim Robbins, Morgan Freeman">Die Verurteilten</a>
<span class="secondaryInfo">(1994)</span>
</td>
我想抓住的是下面这行,但我不确定接下来应该做什么。:
title="Frank Darabont (dir.), Tim Robbins, Morgan Freeman
有什么想法吗?
谢谢
【问题讨论】:
-
循环遍历
direc_b_t中的列表,对于列表中的每个项目,print(item.find('a')['title'])
标签: python web web-scraping