【发布时间】:2021-10-18 07:22:00
【问题描述】:
我有一个具有 100 个 ID 的数据框,每个 ID 裁判到一台机器,对于每个 ID(机器)我有多个记录,如下图所示:
我想为每个 ID 提取 30% 的记录,并将其分别放在一个新的数据框中。 你能帮忙吗?
【问题讨论】:
标签: python python-3.x pandas numpy scikit-learn
我有一个具有 100 个 ID 的数据框,每个 ID 裁判到一台机器,对于每个 ID(机器)我有多个记录,如下图所示:
我想为每个 ID 提取 30% 的记录,并将其分别放在一个新的数据框中。 你能帮忙吗?
【问题讨论】:
标签: python python-3.x pandas numpy scikit-learn
你可以使用groupby+sample:
dataframe.groupby('Id', as_index=False).sample(frac=0.3)
【讨论】:
n values”