【发布时间】:2020-08-15 09:32:32
【问题描述】:
我有一个包含多行的大型数据集,如附图所示。根据Country,我正在尝试获取value_counts 以获得Males 和Females 的总和(在gender 列中)。我还需要满足Hague 字段为Yes 或No 的条件。所以有一个Male/No 和一个Male/Yes,Female 也是如此。我正在尝试在countries 和Hague 上使用 groupby 函数,公式如下:
data_df.groupby('Country')['Gender'].apply(lambda x: x[x== 'M'].count())
使用它,我可以获得特定 gender 的计数,每个 country,但我无法弄清楚将 Hague 设为“YES”和“NO”的条件。
我还想出了如何只在可以选择特定性别和海牙身份的行中添加行。但我不知道如何计算性别列中的男性/女性数量
data_df.loc[(data_df['Hague'] =='NO') & (data_df['Gender'] =='M')]
【问题讨论】:
标签: pandas lambda jupyter-notebook pandas-groupby