【发布时间】:2020-02-22 03:10:22
【问题描述】:
我创建了一个脚本来解析与网站上的某些歌曲相关的一些信息。当我尝试使用this link 或this one 时,我的脚本可以完美运行。我能理解的是,当我在这部分https://www.billboard.com/music/ 之后附加我的搜索关键字时,我得到了包含信息的所需页面。
但是,当我尝试使用这些关键字 1 Of The Girls 或 Al B. Sure! 或 Ashford & Simpson 等时,出现了问题。
我不知道如何在基本链接https://www.billboard.com/music/ 之后附加上述关键字来定位包含信息的页面。
我尝试过的脚本:
import requests
from bs4 import BeautifulSoup
LINK = "https://www.billboard.com/music/Adele"
res = requests.get(LINK)
soup = BeautifulSoup(res.text,"lxml")
scores = [item.text for item in soup.select("[class$='-history__stats'] > p > span")]
print(scores)
我得到的结果(如预期的那样):
['4 No. 1 Hits', '6 Top 10 Hits', '13 Songs']
位于该页面的结果就在chart history 之后,如下所示:
如何使用关键搜索关键字从网页中获取一些信息?
【问题讨论】:
-
URL 可能需要使用某种编码,例如
I%27ll+be+damned或Ashford+%26+Simpson。在直播网站上进行实验,然后搜索urlencode。
标签: python python-3.x web-scraping