【发布时间】:2021-09-20 13:25:55
【问题描述】:
我有以下代码
<paragraph id = "xx">
<text>hello</text>
</paragraph>
<paragraph id = "yy">
<text>bonjour</text>
</paragraph>
<paragraph id = "zz">
<text>guten Tag</text>
</paragraph>
我也有以下向量
id_vector <- c("xx","zz")
我想获取属性id为“xx”或“zz”的段落节点中的文本,即获取一个字符向量
c("hello","guten Tag")
什么是适合与 rvest 一起使用的 XPath? 到目前为止,我已经尝试了以下XPath,但无济于事
"//paragraph[@id = id_vector]/text"
非常感谢您的帮助!
【问题讨论】:
-
这行得通吗? "//段落[@id = 'xx' or @id = 'zz']/text"
-
这很好用,非常感谢。但我很想迭代该过程,并使其适用于包含超过 2 个字符串的数组。您对我如何实现这一目标有任何想法吗?
-
@id 属性是否可以通过某种方式或遵循某种模式进行预测?
-
如果您不介意将 xpath 粘贴在一起(或者
glue/stringr::str_glue函数应该更容易),您可以使用paste(paste("@id", id_vector, sep = "="), collapse = " or ")之类的内容创建内部部分 -
@LMC 不,它们只是随机数 ID