【发布时间】:2021-12-16 06:21:08
【问题描述】:
我是网络抓取的新手,我正在尝试使用 Scrapy 抓取以下网站的发布日期:https://m.imdb.com/title/tt0468569/?ref_=adv_li_tt
这是我正在使用的选择器:
//a[contains(@class,'ipc-metadata-list-item__list-content-item ipc-metadata-list-item__list-content-item--link')]/text()
它返回的元素太多,我只想要发布数据字符串。
【问题讨论】:
-
仅供参考,它是 scraping (以及scrape,scraper,scraped)而不是scraping。报废意味着像垃圾一样扔掉,或者打架。
标签: css web-scraping xpath scrapy