【发布时间】:2020-03-03 14:44:25
【问题描述】:
故事如下:
我有一个包含许多二进制变量的数据集(1 = 是,0 = 否)。问题是其中许多变量是相同的,只是写法不同。 示例:
- 双胞胎
- 格梅利
- DCDA
- MCDA
- 双 DCDA
- 双 MCDA
- ...
这完全取决于医生/他的习惯/他的心情/他的读写能力。如果上述任何变量的观察结果为“1”,则意味着将有双胞胎(怀孕)。现在要对双胞胎做出一些预测和资料,我需要将所有那些在任何可能的变量(有时甚至是其中的 2 个)中具有“1”的观察结果分组。
这是我尝试过的:
features <- mutate(features,
TWIN_P = ifelse("twins" == 1 |
"gemelli" == 1 |
"DCDA" == 1 |
"MCDA" == 1 |
"twin DCDA" == 1 |
"twin MCDA" == 1 ,
"1", "0"))
但是当我查看新变量 TWIN_P 时,我得到了 0 个双胞胎……这当然是不可能的。
谁能告诉我我做错了什么?二进制变量是数字的。我试图在“”之间或没有它们之间执行此操作。但没有什么真正奏效。
提前致谢!
【问题讨论】:
-
不要引用变量名。您可以使用反引号 `` 来表示带有空格的。
标签: r if-statement dplyr