【发布时间】:2020-07-07 00:34:49
【问题描述】:
我想复制 Pandas 数据框中的行。每行应重复 n 次,其中 n 是每行的一个字段。
import pandas as pd
what_i_have = pd.DataFrame(data={
'id': ['A', 'B', 'C'],
'n' : [ 1, 2, 3],
'v' : [ 10, 13, 8]
})
what_i_want = pd.DataFrame(data={
'id': ['A', 'B', 'B', 'C', 'C', 'C'],
'v' : [ 10, 13, 13, 8, 8, 8]
})
这可能吗?
【问题讨论】:
-
有什么理由这样做吗?我认为最好避免数据重复。
-
这是一个中间步骤——我根据概率分布生成“v”列,然后我将通过从另一个数据集中随机选择行来添加另一列。
-
我仍然没有看到不直接这样做的理由。但我需要更多关于你实际想要达到的目标的信息。
-
不确定这里的“直接做”是什么意思?不过,接受的答案正是我想要的。
-
在将因子转换为虚拟变量之前,我正在使用这个中间步骤。