【发布时间】:2020-10-05 16:24:24
【问题描述】:
我正在尝试从此链接获取原始分数:https://www.rottentomatoes.com/m/avengers_endgame/reviews
我收到了一些退货,但这不是我所期望的。我得到一个类似这样的列表:
[<selenium.webdriver.remote.webelement.WebElement (session="e31633b4d123fff6432c6726cc26ad65", element="a9b96431-d527-4b79-8ddd-01d18f362cbd")>
(我只是举了一个例子,但是有一个列表)
这是我用来获得此结果的方法:
rows = driver.find_elements_by_xpath("//div[@class='row review_table_row']")
scores =[]
for row in rows:
scores.append(row.find_elements_by_xpath('//div[contains(concat(" ",normalize-space(@class)," ")," review_desc ")]//div[contains(concat(" ",normalize-space(@class)," ")," small ")]'))
有人知道 xpath 有什么问题吗?
【问题讨论】:
标签: python xpath web-scraping