【发布时间】:2017-12-14 13:47:07
【问题描述】:
我是 R 新手,我有一个数据框,其中有一个字符类列,格式如下:
> head(unique(season_advanced_stats$Player))
[1] "alex abrines\\abrinal01" "quincy acy\\acyqu01" "steven adams\\adamsst01"
[4] "arron afflalo\\afflaar01" "alexis ajinca\\ajincal01" "cole aldrich\\aldrico01"
我尝试使用 gsub,但每次我输入以下代码时,Rstudio 一直输出“+”符号,表明我还没有完成某些事情:
season_advanced_stats$Player = gsub('\', '', season_advanced_stats$Player)
如果有人可以帮助我弄清楚如何正确使用 gsub,以便只剩下玩家姓名,我将不胜感激!
【问题讨论】:
-
您还想删除数字吗?如果没有,请尝试
gsub("\\\\", "",season_advanced_stats$Player) -
我想删除“\\”以及反斜杠后面带有数字的缩写名称。
-
然后试试这个:
gsub("\\\\|\\d", "",season_advanced_stats$Player) -
这很接近,但它仍然输出反斜杠后的字符。你如何建议我删除反斜杠之后的所有内容,以便只保留反斜杠之前的玩家姓名?
标签: r regex dataframe rstudio gsub