【发布时间】:2018-12-22 23:42:11
【问题描述】:
我已经在 python 中结合 selenium 编写了一个脚本来抓取点击不同数字时生成的不同 pdf 链接,如110015710, 110015670 等位于网页的表格中。
我的脚本可以点击这些链接,显示 pdf 文件,但只解析其中的 5 个。
我怎样才能得到它们?
到目前为止我已经尝试过:
from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
link = "replace_with_above_link"
driver = webdriver.Chrome()
wait = WebDriverWait(driver, 10)
driver.get(link)
[driver.execute_script("arguments[0].click();",item) for item in wait.until(EC.presence_of_all_elements_located((By.CSS_SELECTOR,"tr.Iec")))]
for elem in wait.until(EC.visibility_of_all_elements_located((By.CSS_SELECTOR,".IecAttachments li a[href$='.pdf']"))):
print(elem.get_attribute("href"))
driver.quit()
【问题讨论】:
标签: python selenium selenium-webdriver web-scraping