【发布时间】:2016-01-19 23:42:58
【问题描述】:
匹配 R 中的两个列表,一个带有部分字符串,另一个带有完整字符串,如果匹配则返回整个字符串。仅返回唯一匹配项(一次)。
假设我有一个 CSV 文件,并且每一行都有一个长字符串(长列表)。然后,我使用 substr 缩短字符串,然后使用 unique 删除所有重复的字符串。然后我想比较长字符串列表df12和唯一短列表df14,如果部分字符串搜索有唯一匹配(df14 vs df12),然后从df12返回整个字符串.
这是df12(长字符串列表)
[1] I like stackoverflow very much today
[2] I like stackoverflow much today
[3] I dont like stackoverflow very much today
[4] I dont like you!
[5] What?
df13<-substr(df12, start=0, stop=30)
这是df13(缩短的字符串 - 不唯一)
[1] I like stacko
[2] I like stacko
[3] I dont like s
[4] I dont like y
[5] What?
df14<-unique(df13)
这是df14(缩短的字符串 - 应用唯一方法后的唯一字符串)
[1] I like stacko
[2] I dont like s
[3] I dont like y
[4] What?
这是我最终想要的结果
[1] I like stackoverflow very much today
[2] I dont like stackoverflow very much today
[3] I dont like you!
[4] What?
【问题讨论】:
-
df13<-substr(df12, start=0, stop=30)不会为我产生预期的输出。应该是df13<-substr(df12, start=0, stop=13)?
标签: regex r string match substr