【问题标题】:XPath Query for Google Docs ImportXMLGoogle Docs ImportXML 的 XPath 查询
【发布时间】:2015-05-09 07:42:47
【问题描述】:

我正在尝试从 salesforce 中提取一系列笔记,我真的只需要这些笔记的正文,我真的宁愿避免手动复制它们。

我已将笔记的 URL 保存到 Google Docs 电子表格中,我正在尝试使用 ImportXML 函数提取特定信息,但我似乎无法正确获取 xpath 查询。

经过我自己的一些尝试和相当多的研究(我是一个完整的初学者,所以我可能只是在寻找错误的东西)我想出了一个像这样的 xpath 查询:

//div[@class="pbSubsection"]//td[@class="data2Col"][5]//text

这会导致解析错误。

我还发现我可以在 Chrome 和开发者工具中打开 Note,找到表格并右键单击选择 Copy XPath,这给了我:

//*[@id="ep"]/div[2]/div[2]/table/tbody/tr[5]/td[2]

即使我将 //text 附加到末尾。显然,这并不像我要求的那样万无一失;有什么我在这里遗漏的东西,或者我可以使用一些工具来找出这些查询的问题吗?我尝试了 XMLQuire,但运气不佳。

再一次,如果有好心人想查看页面代码(匆忙更改以删除敏感信息)并具体告诉我我缺少什么,我会接受的:

https://www.dropbox.com/s/peo5i47du1vtsmu/test.html

我要提取的文本是:

团队查看器 12345 服务器:客户名称,ST 用户名:管理员 密码:password1

有什么想法吗?提前感谢您的宝贵时间。

【问题讨论】:

  • 在链接页面test.html,您希望提取的值是什么?
  • 嗨,对不起!编辑以添加该文本。

标签: xpath xml-parsing google-sheets salesforce


【解决方案1】:
"//div[@class='pbSubsection']//td[@class='data2Col']/text()"

产量

['Connection Details',
 'teamviewer 12345 \r',
 '\r',
 'Server: Customer Name, ST\r',
 'Username: administrator\r',
 'Password: password1']

【讨论】:

  • @RodrigoM:This page 似乎表明 Google XPath 语法必须在 XPath 周围使用双引号,在内部字符串周围使用单引号。我已经编辑了帖子以说明我的意思。
猜你喜欢
  • 2018-03-28
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多