【发布时间】:2019-11-21 11:01:49
【问题描述】:
我正在使用 Selenium 为同一个表抓取多个 url,但这些表的 xpath 略有不同。
以下是我的编码:
my_urls = ["https://www.sec.gov/cgi-bin/own-disp?action=getowner&CIK=0001548760",
"https://www.sec.gov/cgi-bin/own-disp?action=getowner&CIK=0001366010",
"https://www.sec.gov/cgi-bin/own-disp?action=getowner&CIK=0001164390"]
driver = webdriver.Chrome()
for url in my_urls:
driver.get(url)
export_table=driver.find_elements_by_xpath('')[0]
export_table.text
xpath1:/html/body/div/table[1]/tbody/tr[2]/td/table/tbody/tr[3]/td/table/tbody
xpath2:/html/body/div/table[1]/tbody/tr[2]/td/table/tbody/tr[2]/td/table/tbody
如何使用一个 xpath 从这些 url 中提取内容?并将所有结果导出到字典?
感谢您的帮助!
【问题讨论】:
-
一个 xpath 会使用特定的 url 而不是另一个吗?如果是这样,您应该只在每个 xpath 上使用
try:...except:...finally表达式 -
试试这个 xpath - //tbody/tr[2]/td//td/table/tbody
标签: python html loops selenium xpath