【发布时间】:2018-10-30 05:42:19
【问题描述】:
我正在抓取这个网站:https://www.findinall.com/finance-category-396
我正在使用 Selenium(Python) 并在名为“Showing”的下拉菜单中的选项 300 上执行单击选项。点击自动成功,网页将12个页面的全部数据集中显示在一个页面中,但是数据抓取后,只获取到前12个数据项,即page_source没有变化。
这是我的代码:
from selenium import webdriver
driver=webdriver.Chrome("/home/ronith/Downloads/chromedriver")
driver.get('https://www.findinall.com/finance-category-396/#')
driver.find_element_by_xpath("//select[@name='per_page']/option[@value
='300']").click()
driver.implicitly_wait(5)
data=driver.find_elements_by_xpath('//div[@class="pro-list-tb mt15"]')
for i in range(len(data)):
print(data[i].text,'\n\n')
driver.close()
我想抓取执行点击操作后可用的全部数据。我在这里做错了什么?
【问题讨论】:
-
了解
implicit wait和explicit wait之间的区别将帮助您解决问题。在页面有机会刷新所有 300 条记录之前,您正在填充您的data列表。 selenium-python.readthedocs.io/waits.html
标签: python selenium web-scraping selenium-chromedriver