【发布时间】:2020-10-18 05:44:53
【问题描述】:
所以发布了这个问题的许多变体,但它们都不是我正在寻找的。p>
我有一个数据集,其中包含多个包含布尔值的列,这些值指示用户是否在其居住地列出了城市名称。用户可以命名多个城市名称。见下文。
日期集示例:
+----+----------+-------+-------------+------------------------------------+
| ID | New York | LA | New Orleans | New Var |
+----+----------+-------+-------------+------------------------------------+
| 1 | True | False | True | 'New York, NY', 'New Orleans, LA' |
| 2 | True | False | False | 'New York, NY |
| 3 | False | False | False | 'None' |
+----+----------+-------+-------------+------------------------------------+
我要做的是创建一个新列,用于存储用户列出的所有城市名称的文本名称。我可以用一百万个嵌套的 if 条件来做到这一点,但我确信在 Pandas 中有更好的方法来做到这一点。谁能指出我正确的方向?
数据集图片链接:
【问题讨论】:
-
用户 ID 列在哪里?
-
每一行都有一个唯一的用户 ID 值。我已经编辑了我的示例以反映这一点。
-
当然。新列“New Var”是我想要得到的输出。
标签: python pandas data-analysis data-manipulation