【发布时间】:2020-03-11 15:26:54
【问题描述】:
+---------+---------+-------+
| g_var_1 | g_var_2 | group |
+---------+---------+-------+
| A | B | 1 |
+---------+---------+-------+
| B | A | 1 |
+---------+---------+-------+
| C | D | 2 |
+---------+---------+-------+
| D | C | 2 |
+---------+---------+-------+
| E | F | 3 |
+---------+---------+-------+
| F | E | 3 |
+---------+---------+-------+
| G | H | 4 |
+---------+---------+-------+
| H | G | 4 |
+---------+---------+-------+
使用熊猫: 我正在尝试基于“g_var_1”和“g_var_2”创建一个“组”变量。从上面的 ASCII 表中可以看出,逻辑是“g_var_1”和 g_var_2”的相同组合被组合在一起。因此 (g_var_1 == "A" 和 g_var_2 == "B") 的观察结果将在与 (g_var_1 == "B" 和 g_var_2 == "A") 的观察相同的组。
我正在使用的数据集有一千多行,因此手动执行此操作对我来说不是最佳解决方案。
任何帮助将不胜感激。提前致谢!
【问题讨论】:
标签: pandas grouping pandas-groupby