【发布时间】:2022-07-07 21:21:59
【问题描述】:
我正在尝试找出一种非循环方式来识别(自动递增 int 将是理想的)非唯一的行组(一个组可以包含 1 行或更多行)内每个 GroupID。
这是一个看起来像的示例 DataFrame
| Index | Cents | SD_YF | GroupID |
|---|---|---|---|
| 10 | 182.5 | 2.1 | 0 |
| 11 | 182.5 | 2.1 | 0 |
| 12 | 153.5 | 1.05 | 1 |
| 13 | 153.5 | 1.05 | 1 |
| 14 | 43 | 11 | 2 |
| 15 | 43 | 11 | 2 |
| 4 | 152 | 21 | 2 |
| 5 | 152 | 21 | 2 |
我的理想输出是:
| Index | Cents | SD_YF | GroupID | UniID |
|---|---|---|---|---|
| 10 | 182.5 | 2.1 | 0 | 1 |
| 11 | 182.5 | 2.1 | 0 | 2 |
| 12 | 153.5 | 1.05 | 1 | 3 |
| 13 | 153.5 | 1.05 | 1 | 4 |
| 14 | 43 | 11 | 2 | 5 |
| 15 | 43 | 11 | 2 | 6 |
| 4 | 152 | 21 | 2 | 5 |
| 5 | 152 | 21 | 2 | 6 |
我已将#5 加粗以提请注意索引 14、4 是如何配对在一起的。与#6 类似。我希望这是有道理的!
【问题讨论】: