【发布时间】:2019-11-21 12:32:46
【问题描述】:
我有一个数据集,其中包含个人姓名及其电话号码 Tel_1 和 Tel_2。这些电话号码有的没有任何条目,有的用 0 或 00000 填充
|-------|:-------:|-------:|
| Tom | 87669 | |
| Dave | 0 | |
| Jess | 0 | 767589 |
| Mike | 5673254 | 755995 |
| Jerry | | 43789 |
| Yen | | |
| Mary | 34545 | |
我希望以两种方式输出,一种是从任一电话号码生成包含零值或缺失值的记录,如下所示:
| Name | Tel_1 | Tel_2 |
|-------|:-----:|-------:|
| Tom | 87669 | |
| Dave | 0 | |
| Jess | 0 | 767589 |
| Jerry | | 43789 |
| Yen | | |
| Mary | 34545 | |
另一个会从两个电话号码中生成包含0或缺失值的记录,如下所示:
| Name | Tel_1 | Tel_2 |
|-----:|-------|-------|
| Dave | 0 | |
| Yen | | |
【问题讨论】:
-
将
&用于和,|用于或。到目前为止,您尝试过什么,您在哪里卡住了? -
@Gregor 由于数据集包含空白值,我不确定如何使用逻辑运算符。我能想到的一种方法是在 Tel1 和 Tel2 上分别使用 complete.cases,然后使用 join 函数。
-
你是什么空白?它们是空字符串
""吗?还是NA值?我认为使用complete.cases根本没有用... -
@Gregor 它们缺少值并在 R 中表示为 NA。我的原始文件是 excel 表。
标签: r subset na missing-data