【发布时间】:2018-04-23 15:28:27
【问题描述】:
我又一次为strsplit 苦苦挣扎。我正在将一些字符串转换为数据帧,但是有一个正斜杠 / 和我的字符串中的一些空白一直困扰着我。我可以解决它,但我很想知道我是否可以在strsplit 中使用一些花哨的东西。我下面的工作示例应该说明问题
我目前正在使用的strsplit 函数
str_to_df <- function(string){
t(sapply(1:length(string), function(x) strsplit(string, "\\s+")[[x]])) }
我得到的一种字符串,
string1 <- c('One\t58/2', 'Two 22/3', 'Three\t15/5')
str_to_df(string1)
#> [,1] [,2]
#> [1,] "One" "58/2"
#> [2,] "Two" "22/3"
#> [3,] "Three" "15/5"
我在同一个地方找到的另一种类型,
string2 <- c('One 58 / 2', 'Two 22 / 3', 'Three 15 / 5')
str_to_df(string2)
#> [,1] [,2] [,3] [,4]
#> [1,] "One" "58" "/" "2"
#> [2,] "Two" "22" "/" "3"
#> [3,] "Three" "15" "/" "5"
它们显然会创建不同的输出,我不知道如何编写一个对两者都有效的解决方案。以下是我想要的结果。先感谢您!
desired_outcome <- structure(c("One", "Two", "Three", "58", "22",
"15", "2", "3", "5"), .Dim = c(3L, 3L))
desired_outcome
#> [,1] [,2] [,3]
#> [1,] "One" "58" "2"
#> [2,] "Two" "22" "3"
#> [3,] "Three" "15" "5"
【问题讨论】:
-
您可以用任何非单词(字母数字)字符分割:
t(simplify2array(strsplit(string1, '\\W+')))
标签: strsplit strsplit strsplit r dataframe strsplit