【发布时间】:2018-07-12 19:33:31
【问题描述】:
我正在尝试在此页面的 to 处抓取实时数据: https://www.wallstreet-online.de/devisen/euro-us-dollar-eur-usd-kurs/realtime
我目前的方法:
import time
import re
import bs4 from bs4 import BeautifulSoup as soup
import requests
while (1==1):
con = requests.request('get','https://www.wallstreet-
online.de/devisen/euro-us-dollar-eur-usd-kurs/realtime', stream = True)
page = con.text
kursSoup = soup(page, "html.parser")
kursDiv = kursSoup.find("div", {"class":"pull-left quoteValue"})
print(kursDiv.span)
del con
del page
del kursSoup
del kursDiv
#time.sleep(2)
print("end")
有效,但与网站上的数据不同步。我真的不明白为什么,因为我在循环结束时删除了所有变量,所以当网站上的数据发生变化时结果应该会发生变化,但似乎在固定的时间内保持不变。有谁知道为什么或有更好的方法来做到这一点(我是一个该死的初学者,不知道该网站是如何工作的,这就是我解析 html 的原因)。
【问题讨论】:
-
我已回滚您的编辑:请不要在问题本身中包含解决方案;相反,请在revision history 中找到它并将其作为自己的答案发布。
标签: python web-scraping automation python-requests stocks