【发布时间】:2020-08-07 16:59:50
【问题描述】:
我正在尝试从该网页和许多类似网页中抓取信息,https://knowyourcity.info/settlement/1846/5119249
查看页面源时,页面顶部的多边形坐标可用,但在检查多边形元素时不可用。有人知道如何使用 Python 中的 BeautifulSoup 包将这些坐标刮到数据框的列中吗?
这是我用来访问网站的代码
from requests import get
url = 'http://knowyourcity.info/settlement/1846/5119249'
response = get(url)
print(response.text[:500])
from bs4 import BeautifulSoup
html_soup = BeautifulSoup(response.text, "html.parser")
type(html_soup)
【问题讨论】:
-
是否要从页面获取此信息:
[["5.599769999885609","-0.224459999729163"],["5.599920830581937","-0.2235293057328249"] ...? -
是的,没错!
标签: python web-scraping beautifulsoup