【发布时间】:2018-07-09 22:09:22
【问题描述】:
我有一个包含大约 300 个特征和 100 万个观察值的数据框。我创建了一个列表变量,其索引值包含 80% 的数据作为 NA 值。
我的索引列表有 -> 2,4 我想为数据框索引为 2 ,3 的列创建一个指示变量,以将 NA 值替换为“0”,将列中的其他值替换为“1”
我尝试循环遍历每一行,但由于数据量很大,循环它需要很长时间。
输入数据框 -> df
行 col1 col2 col3
一个 NA 1 3
一个 不适用 1 不适用
一个 2 2 NA
预期输出:
行 col1 col2 col3
一个 0 1 1
一个 0 1 0
一个 1 2 0
谁能指出我正确的方向以更快地实现这一目标。
谢谢,
雷努卡
【问题讨论】: