【发布时间】:2017-10-30 11:08:04
【问题描述】:
我尝试抓取这个page:
目标是收集经纬度。但是,我看到 HTML 内容在“地址”情况下提交后没有改变,我不知道这是否是我的“空列表”的问题。
我的脚本:
import requests
from bs4 import BeautifulSoup
from selenium import webdriver
url = "https://www.coordonnees-gps.fr/"
chrome_path = r"C:\Users\jbourbon\Desktop\chromedriver_win32 (1)\chromedriver.exe"
driver = webdriver.Chrome(chrome_path)
driver.maximize_window()
driver.get(url)
r = requests.get(url)
soup = BeautifulSoup(r.content, "html.parser")
g_data = soup.findAll("div", {"class": "col-md-9"})
latitude = []
longitude = []
for item in g_data:
latitude.append(item.contents[0].findAll("input", {"id": "latitude"}))
longitude.append(item.contents[0].findAll("input", {"id": "longitude"}))
print(latitude)
print(longitude)
在这里,我的list拥有什么
泰:)
【问题讨论】:
-
你为什么用
Selenium标签标记你的问题?您是否对Selenium进行了同样的尝试?如果是这样,也添加此代码
标签: python-3.x selenium web-scraping beautifulsoup selenium-chromedriver