【发布时间】:2021-09-13 03:07:27
【问题描述】:
我正在尝试抓取一个网站,您可以在下面的代码中找到它的链接
目标是从属性中获取数据,因为在检查代码时没有文本
这是一个元素的完整 XPath:
/html/body/div[2]/div[3]/div/div[3]/section[1]/div/div[2]/div[1]
和代码:
import requests
from lxml import html
page = requests.get('https://www.meilleursagents.com/annonces/achat/nice-06000/appartement/')
tree = html.fromstring(page.content)
尝试使用以下方法抓取属性“data-wa-data”值:
tree.xpath('/html/body/div[2]/div[3]/div/div[3]/section[1]/div/div[2]/div[1]/@data-wa-data')
产生空值
同样的问题出现在另一个有文本的元素上:
tree.xpath('/html/body/div[2]/div[3]/div/div[3]/section[1]/div/div[2]/div[1]/div/a/div[1]/text()')
【问题讨论】:
标签: python html web-scraping xpath lxml