【发布时间】:2012-03-07 09:26:40
【问题描述】:
我正在尝试寻找一种工具来从网页中捕获项目。首先,我使用了 xpath finder Firefox 插件,但有时它会生成带有模式的 xpath(xpath 2.0),所以它不适合
以下是使用 firepath (firefox) 为 google 搜索按钮生成的绝对 xpath
html/body/div[2]/div[1]/div[1]/div[2]/div[2]/div/form/div[1]/button[1]
当我尝试时
doc.DocumentNode.SelectSingleNode("html/body/div[2]/div[1]/div[1]/div[2]/div[2]/div/form/div[1]/button[1]").InnerText;
它给出了空引用异常。
所以我也不能使用火路。
我需要一个与 HTML Agility Pack 配合使用的工具。或者需要找出上面为什么不起作用。
【问题讨论】:
-
没有看到HTML文件的结构,很难给出答案。尝试使用
/开始 XPath 声明来根它。此外,button元素 真的 是否包含任何InnerText???