【发布时间】:2017-08-15 04:14:15
【问题描述】:
我有两个略有不同的网址:https://www.booli.se/annons/2278076、https://www.booli.se/bostad/507292
第一页和第二页的区别:第二页没有Utropspris(估计价格)。
在第一个链接中,我将使用以下代码获得估计价格(Utropspris):
in[1]= soup.findAll('span', class_='property__base-info__value')[1].text.strip()
out[1]= u'3 800 000 kr\n\t\t\t64 407 kr/m\xb2'
但是在第二个链接中使用我上面使用的相同代码,我将获得费用(Avgift)
in[2]= soup.findAll('span', class_='property__base-info__value')[1].text.strip()
out[2]= u'4 425 kr/m\xe5n'
我如何告诉我的代码,当我在第二个链接中使用相同的代码时,这不再是估计价格 (Utropspris)。这是费用(avgift),将其保存为费用,并为估计价格写 NA。这是我的代码的一部分,可能会有所帮助。
url=https://www.booli.se/bostad/507292
import requests
from bs4 import BeautifulSoup
request = requests.get(url)
soup = BeautifulSoup(request.text,'lxml')
soup.findAll('span', class_='property__base-info__value')[1].text.strip()
【问题讨论】:
标签: python web-scraping beautifulsoup