【发布时间】:2019-06-24 13:11:15
【问题描述】:
我正在尝试抓取此网站Century Office Products, Inc,但无法抓取此文本:
Century Office Products, Inc. industry is listed as Ret Misc Merchandise
因为包含它的标签是#text。以下是我尝试过的代码:
driver.get('https://www.corporationwiki.com/New-Jersey/Middlesex/century-office-products-inc/53844156.aspx')
text = [k.text for k in driver.find_elements_by_xpath("//div[@class='card']//div[@class='card-body']//h2//following::p[2]")]
【问题讨论】:
-
所以,您愿意解析您在描述中的双引号中提到的那个网站的那部分文本,对吧?
-
@SIM 是的,其他我可以废弃的东西。
标签: python-3.x python-2.7 selenium-webdriver web-scraping