【发布时间】:2020-08-24 12:14:23
【问题描述】:
我想通过使用 selenium 驱动程序包从各种网页中提取元素。我使用 find_elements_by_xpath 通过文本识别目标元素。虽然我认为我能够解决“空格”、“breaks”等问题,但我的代码找不到以下元素 ,很遗憾。
这是我试图通过其文本找到的 元素:
x = """<p align="left"><font face="Arial" color="#439539" size="5">Compensation
Discussion<br>& Analysis</font></p>"""
这是各个webpage的原始代码截图。
这是我目前用来识别包含文本“薪酬讨论与分析”的元素的代码:
searchterm = "Compensation Discussion & Analysis
driver.find_elements_by_xpath("//*[contains(normalize-space(translate(., '\u00A0', ' ')), '" + searchterm + "')]")
我知道可能有一些方法可以只包含我的部分搜索词,例如 starts-with() 等。但是,我更愿意继续查找整个搜索词,而不是将其拆分为多个组件。
非常感谢任何帮助!提前非常感谢!
【问题讨论】:
标签: python html selenium xpath