【问题标题】:Change names of observations in a data frame [duplicate]更改数据框中观察的名称[重复]
【发布时间】:2023-03-08 16:43:01
【问题描述】:

我正在尝试通过修剪结尾的“_C1_A1”并添加前缀“RNA_”来重命名数据框中的 9000 个观察值

df
ID                   MP Value
FFP16-000123_C1_A1       -1
FFP16-000124_C1_A1        0
FFP16-000125_C1_A1        1

df
ID                    MP Value
RNA_FFP16-000123         -1
RNA_FFP16-000124          0 
RNA_FFP16-000125          1   

【问题讨论】:

标签: r


【解决方案1】:

要仅替换“_C1_A1”后缀,请使用函数 paste0 和 gsub:

df$ID <- paste0("RNA_", gsub("_C1_A1", "", df$ID))

要对所有以下划线开头的后缀进行相同的更改,您可以使用正则表达式“_.*”作为 gsub 的第一个参数:

df$ID <- paste0("RNA_", gsub("_.*", "", df$ID))

【讨论】:

  • 感谢您的建议。几乎做到了,但我的数据有许多不同的后缀(即 C1_A1、C2_A1、C1_A3 等)。有没有办法指定要修剪的字符数而不是确切的字符。
  • 我认为在这种情况下,最简单的方法是简单地删除第一个下划线之后的所有内容......请查看我修改后的答案,如果它不能解决问题,请告诉我。
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2020-03-26
  • 1970-01-01
  • 2011-02-21
  • 2016-09-09
  • 2022-12-08
  • 2020-02-20
  • 1970-01-01
相关资源
最近更新 更多