【发布时间】:2019-12-13 01:27:41
【问题描述】:
我正在做一个数据分析项目,并试图从网站 'turo.com' 获取数据;无法从特定“div”标签下的特定“span”标签中抓取数据。以下是代码:
from requests import get
url = "https://turo.com/en-us/search?country=US&defaultZoomLevel=13&delivery=false&deliveryLocationType=googlePlace&endDate=12%2F17%2F2019&endTime=10%3A00&international=true&isMapSearch=false&itemsPerPage=200&latitude=34.0929744&location=Alhambra%20High%20School%2C%20South%202nd%20Street%2C%20Alhambra%2C%20CA%2C%20USA&locationType=Address&longitude=-118.1284232&maximumDistanceInMiles=50&placeId=ChIJsZLFwSbFwoARDVnxkdATxS0®ion=CA&sortType=RELEVANCE&startDate=12%2F14%2F2019&startTime=10%3A00"
response = get(url)
from bs4 import BeautifulSoup
html_soup = BeautifulSoup(response.text, "html.parser")
carName = html_soup.find(class_ = "vehicleCard-makeModel")
carYear = html_soup.find(class_ = "vehicleCard-year")
carTrip = html_soup.find(class_ = "vehicleRatingAndTrips-trips")
carAllStart = html_soup.find(class_ = "allStarHostBadge-icon")
#JoinTime = html_soup.find(class_ = "media-body hostDetailCard-info")
# carStart = html_soup.find(class_ = "starRating vehicleWithDetailsInfo-attribute vehicleWithDetailsInfo-attribute--starRating")
#print(carName.text, carYear.text)
#print(carTrip.text)# print(carStart.)
#print(carAllStart.text)
#print(JoinTime.div.text[: -14])
print(carName)
print(carYear)
print(carTrip)
print(carAllStart)
#print(JoinTime)
结果如下:
None
None
None
None
【问题讨论】:
-
您是否尝试查看请求返回的实际 HTML?这才是最重要的。
标签: python html web-scraping beautifulsoup