【发布时间】:2018-05-27 11:37:19
【问题描述】:
假设我有这个数据框
id | car | sex | income
-------------------------------
1 | European | Male | 45000
2 | Japanese | Female | 48000
3 | American | Male | 53000
有没有一种简单的方法来创建这个(使用熊猫)?
| id | car | choice | sex | income
1.| 1 | European | 1 | Male | 45000
2.| 1 | American | 0 | Male | 45000
3.| 1 | Japanese | 0 | Male | 45000
| ----------------------------------------
4.| 2 | European | 0 | Female | 48000
5.| 2 | American | 0 | Female | 48000
6.| 2 | Japanese | 1 | Female | 48000
| ----------------------------------------
7.| 3 | European | 0 | Male | 53000
8.| 3 | American | 1 | Male | 53000
9.| 3 | Japanese | 0 | Male | 53000
我们的想法是在基础中获取“汽车”变量的每种模态,并通过“选择”变量指示每个人选择了哪一个。例如,在第一个表中,id 为 1 的人选择了一辆欧洲汽车,因此 choice 在 car 是欧洲的那一行中等于 1,在 car 等于美国的那一行中为零日语。
我已经编写了一些手动完成的代码(使用字典),但我想知道是否存在更简洁的解决方案。
(这是为了格式化数据以便在 Stata 下使用 asclogit/nlogit)
【问题讨论】: