【发布时间】:2017-04-24 11:28:18
【问题描述】:
我有 80,000 个据说使用相同格式的 XML 文件。然而,情况显然并非如此。因此,我试图识别文件中所有现有的节点和子节点。
我已使用 XML 包将 XML 文件作为列表导入,并在下文中描述了我的输入和所需的输出。
输入(列表的列表):
XML1 <- list(name = "Company Number 1",
adress = list(street = "JP Street", number = "12"),
product = "chicken")
XML2 <- list(name = "Company Number 2",
company_adress = list(street = "House Street", number = "93"),
invoice = list(quantity = "2", product = "phone"))
XML3 <- list(company_name = "Company Number 3",
adress = list(street = "Lake Street", number = "1"),
invoice = list(quantity = "2", product = "phone", list(note = "Phones are refurbished")))
输出(跨文件的树结构,叶子出现次数):
List of 5
$ name : num 2
$ company_name : num 1
$ adress :List of 2
..$ street: num 2
..$ number: num 2
$ company_adress:List of 2
..$ street: num 1
..$ number: num 1
$ invoice :List of 3
..$ quantity: num 2
..$ product : num 2
..$ :List of 1
.. ..$ note: num 1
$ product : num 1
有没有一个包可以做这方面的事情,还是我需要自己编写一个函数来做这件事?
【问题讨论】:
标签: r xml list tree nested-lists