【发布时间】:2019-03-14 01:33:07
【问题描述】:
我是一名 R 用户,目前正在学习 python。
通常,我使用 dplyr 对数据进行分组和汇总。例如,
data1 %>%
dplyr::group_by(city) %>%
dplyr::summarize(unique_customers = n_distinct(user_id, na.rm = TRUE),
converted_customers = n_distinct(user_id[type == "CONVERTED"], na.rm = TRUE)) %>%
data.frame()
我已经能够实现 group_by 和 unique_customers,但是在 python 中放置条件 type == "CONVERTED" 时遇到了一些麻烦。我该怎么做?
编辑: 我现在的python代码:
data1.fillna(method = "ffill").groupby("city").agg({"user_id": "nunique"})
【问题讨论】:
-
apply(lambda x: (x=='CONVERTED')) ::: 类似于你想要在 R 中实现的目标
-
我正在使用以下代码获取每个城市的唯一客户数量:data1.fillna(method = "ffill").groupby("city").agg({"user_id": "nunique "}) 但我想从另一列“类型”应用过滤器,它应该被过滤为仅转换,类似于 sql 中的语句时的情况。这就是我卡住的地方。 @roganjosh
-
熊猫或纯python都可以。
-
我只找到了“pandas-groupby”标签。希望这行得通。
-
我已经为你添加了熊猫标签
标签: python r pandas dplyr pandas-groupby