【问题标题】:Read Multiple HTML Tables from Webpage in Single Data Scraping in UIPath在 UIPath 中的单个数据抓取中从网页中读取多个 HTML 表
【发布时间】:2018-10-25 12:38:09
【问题描述】:

我正在尝试使用 UIPath 从以下 URL 中提取数据 https://www.marketwatch.com/tools/stockresearch/globalmarkets/intindices.asp

我的要求是从上面的链接在 UiPath 中生成 5 个数据表,每个数据表用于全球、美洲等。

这里我使用数据抓取 5 次将全球、美洲等数据提取到 UIPath 中的 5 个不同的数据表中。

有没有最简单的方法来完成这项任务,比如进行一次数据抓取并生成 5 个数据表?

【问题讨论】:

    标签: rpa uipath


    【解决方案1】:

    五个不同的数据表听起来很合理,但是使用五次时,抓取向导会产生大量开销。您不需要序列中的序列,也不需要多次附加浏览器。我会创建一个简单的Open Browser 活动,然后使用抓取向导五次,最后将ExtractData 活动移动到第一个Do 序列中,例如:

    【讨论】:

    • 感谢@Wolfgang Radl 的回答。正如您所说,我正在尝试使用 Extract Structured Data 活动来提取数据,但是您为 Extract Structured Data 活动的输入属性 Extractmetadata 提供了什么。
    • ExtractMetadata 只是一个 XML 字符串,指示您要从给定页面中准确提取的内容。但是,您不必自己编写选择器并填充 ExtractMetadata - 只需使用数据抓取向导即可。但是,正如我在答案中指出的那样,使用它五次会产生很多开销。因此,只需将所有 ExtractData 活动剪切并粘贴到一个序列中即可。
    • 感谢@Wolfgang Radl。
    【解决方案2】:

    您可以使用 find children 活动,它会为您提供父元素下的所有子元素。您所要做的就是指出您的表格所在的父元素。然后使用 for each activity 遍历所有元素。将每个属性的参数类型更改为 uipath.core.uielement。添加 if 条件 item.get("tag").equals("TABLE")。然后使用数据 scraping 并提取任何表并删除其中的所有选择器。在属性窗格中,在元素框中输入项目。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2016-09-27
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多