【问题标题】:Python Web-scraping youtube.com BeautifulSoup4 problemPython Web-scraping youtube.com BeautifulSoup4 问题
【发布时间】:2021-12-25 07:34:45
【问题描述】:

我正在尝试通过使用 BeautifulSoup4 进行网络抓取来获取 YouTube 主页上每个视频的作者。

这是我要导航到的 HTML 块。

<a class="yt-simple-endpoint style-scope yt-formatted-string" spellcheck="false" href="/c/ApertureScience" dir="auto">Aperture</a>

附上链接:https://www.youtube.com/

我正在尝试获取“Ap​​erture”项目。

问题是我似乎无法正确导航到数据,我一直在尝试这个:

source = urllib.request.urlopen('https://www.youtube.com/').read()
soup = bs.BeautifulSoup(source,'lxml')
for i in soup.find_all('a', class_='yt-simple-endpoint style-scope yt-formatted-string'):
    print(i)

没有打印出来,我认为这是因为类名中有奇怪的空格,但我不知道如何解决这个问题。

如果有任何帮助,谢谢!

【问题讨论】:

标签: python html python-3.x web-scraping python-requests


【解决方案1】:

试试语法:

find_all('a',{'class' : 'yt-simple-endpoint style-scope yt-formatted-string'})

对于“Aperture”,请使用字符串或内容或文本。

如果内容是动态的,您可以使用 Selenium。

【讨论】:

  • 谢谢 我从@gre_gor 了解到内容是动态的,我应该使用 Selenium,谢谢。
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2018-04-07
  • 2019-09-06
  • 1970-01-01
  • 2019-01-06
  • 2012-04-12
  • 2023-02-24
  • 2013-05-13
相关资源
最近更新 更多