【发布时间】:2021-08-13 00:45:39
【问题描述】:
我正在使用 BeautifulSoup 在亚马逊网站上网页抓取产品,但是当我运行代码时:
import requests
from bs4 import BeautifulSoup
import smtplib
URL = 'https://www.amazon.com.br/What-Wonderful-World-Inio-Asano/dp/6555941197/ref=sr_1_1?
__mk_pt_BR=%C3%85M%C3%85%C5%BD%C3%95%C3%91&dchild=1&keywords=inio+asano&qid=1628810938&sr=8-1'
headers = {"user-agent":'Mozilla/5.0 (Windows NT 6.3; Win64; x64) AppleWebKit/537.36 (KHTML,
like Gecko) Chrome/92.0.4515.131 Safari/537.36'}
def check_price():
page = requests.get(URL, headers= headers)
soup = BeautifulSoup(page.content, 'html.parser')
title= soup.find(id="productTitle").get_text()
price = soup.find(id ="price").get_text()
converted_price = float(price[0:2])
我收到错误消息说标题和价格是非类型对象。我该如何解决这个问题?
【问题讨论】:
标签: python web-scraping beautifulsoup data-science non-type