【发布时间】:2020-05-25 12:49:26
【问题描述】:
我有一个数据集,其中一列如下。我想根据以下条件创建一个新列
我知道下面的代码将满足条件
np.where((df['col']==1),((df['col'] != df1['col'].shift(1)).astype(int).cumsum()),0)
但是,如果我将代码放在某个循环中,我不希望 cumsum() 再次从 1 开始。它最终会创建重复项。我该如何克服这个问题??
是否可以为特定条件生成随机数?因此,如果它在循环内,我仍然会创建随机数而不是重复数
column_name
1
0
0
1
1
1
1
0
0
1
column_name -- ID
1 -- 1
0 -- 0
0 -- 0
1 -- 2
1 -- 2
1 -- 2
1 -- 2
0 -- 0
0 -- 0
1 -- 3
【问题讨论】:
标签: python pandas data-science data-analysis data-transform