【发布时间】:2019-09-18 19:02:33
【问题描述】:
我想创建一个 DDDD 列,该列自动递增并按 key 和 tag_en 列分组。如果tag_en上的值相同,那么DDDD值也一样
我用 group by 和 cumcount 尝试过 pandas
df1['DDDD'] = df1.groupby(['key']).cumcount()+1
这是图像的链接,我希望数据如何以及我得到了什么 https://imgur.com/8KAlAYe
编辑:对不起,这是我的错,我只是发现每次出现新键时我都需要从零开始重置 DDDD 值https://imgur.com/MEnDOO7
【问题讨论】:
-
使用
df1['DDDD'] = df1.groupby(['key','tag_en']).ngroup() -
编辑:对不起,这是我的错,我只是发现每次出现新键时,我都需要从 1 imgur.com/MEnDOO7 开始重置 DDDD 值
-
然后使用
df1['DDDD'] = df1.groupby('key').ngroup() -
我能否以某种方式更改 DDDD 列以便从 0001 而不是 0000 开始
-
恐怕如果不按DDDD列的值将tag_en放在组中,将都一样imgur.com/j0EsBtX