【发布时间】:2013-09-08 08:42:54
【问题描述】:
我想创建一个脚本来下载 html、解析表格并将其保存到电子表格中。我一直在下载和解析。
表的 Xpath 是:
/html/body/table/tbody/tr[5]/td/table/tbody/tr/td[2]/table
目前我一直在解析 Xpath。
function fetchIt() {
var fetchString="http://www.zbranebrymova.com/index.php?s_lev=22&type=nabku*signa"
var response = UrlFetchApp.fetch(fetchString);
var xmlDoc = Xml.parse(response.getBlob().getDataAsString(),true);
var b = xmlDoc.getElement().getElement("body").getElement("table") ;
Logger.log(b);
}
【问题讨论】:
-
查看stackoverflow.com/questions/18241029/… 关于
<tbody/>标签(例如,外部表肯定没有任何标签)。如何共享一个示例电子表格文档供我们使用(例如,共享为只读 URL)。顺便说一句,HTML 被严重破坏,以至于 Google Spreasheet 的ImportXML甚至都不想解析它。 -
您能否更具体地说明您是如何陷入困境的?您显示的代码 - 它会引发错误吗?它会给出错误的结果吗?到目前为止还可以,但您只是不知道如何获得第 5 个
<tr>孩子?
标签: html parsing xpath google-apps-script