【发布时间】:2018-03-16 19:37:36
【问题描述】:
我是 Pandas 和 Python 的新手。我将通过一个例子来写我的问题。我有一个数据,例如
df = pd.DataFrame([[1, 2], [1, 3], [4, 6], [5,6], [7,8], [9,10], [11,12], [13,14]], columns=['A', 'B'])
df
A B
0 1 2
1 1 3
2 4 6
3 5 6
4 7 8
5 9 10
6 11 12
7 13 14
我从两列中抽取 3 个样本。
x = df['A'].sample(n=3)
x = x.reset_index(drop=True)
x
0 7
1 9
2 11
y = df['B'].sample(n=3)
y = y.reset_index(drop=True)
y
0 6
1 12
2 2
我想进行 10 次采样 (n=3)。
我试过[y] * 10,它在 6、12、2 中产生 10 次列。我想从主要数据中执行 10 次。然后我想从 A 和 B 生成的这些新列中创建一个新数据。
我想也许我应该写 for 循环,但我对它们不太熟悉。
感谢您的帮助。
【问题讨论】:
-
那么,让我来做对了……你想要相同的 3 个值重复 10 次吗?
-
你想要的输出是什么?您是否想要更换样品?
-
哦,不,我不想要相同的 3 个值。每次我都希望从 df 数据框中获取新数据。 10 次新数据,来自 A 和 B 列。
标签: python pandas dataframe random