【发布时间】:2020-04-12 16:52:47
【问题描述】:
iMacros 版本:10.0.2.1450(免费)、Firefox、WINdow 10
你好, 目的是为从website 显示的每个图像提取 HTML DOM 属性的值,例如 id、href 和 data-download-file-url。我相信 XPATH 将适合这项任务,因为每个图像都可以通过以下泛化 XPATH 访问
/html/body/main/section[2]/div/div/figure[X]/div
大写X表示上述网站的取值范围为1到50的Image标签。
我知道,以提取图1的属性为例,可以通过
TAG XPATH="/html/body/main/section[2]/div/div/figure[1]" EXTRACT=TXT
但是,上面的行输出了所有 DOM 属性,包括我不感兴趣的属性。
根据下面的教程;
[OP1][https://forum.imacros.net/viewtopic.php?t=26155] [OP2][How to extract specific text with imacros xpath
提取特定的 DOM 属性可以通过以下方式实现
TAG XPATH="/html/body/main/section[2]/div/div/figure[1]/div[@id='showcase__content'] " EXTRACT=TXT
但是,执行反而报错。
如果有人能阐明这个问题,我真的很感激。
图 1 的 DOM 属性示例。这些属性都是粉红色的。 https://drive.google.com/open?id=190q615C3uXLZUQNI8K4AJYL3Slii1ktO
【问题讨论】:
标签: javascript xpath web-scraping macros imacros