【发布时间】:2022-10-13 02:21:33
【问题描述】:
我有一个如下所示的表:
| device | session |
|---|---|
| a1 | 1 |
| a1 | 1 |
| a1 | 4 |
| a1 | 5 |
| a1 | 5 |
| a1 | 5 |
| a2 | 1 |
| a2 | 2 |
| a2 | 2 |
我想计算由device 和session 分组的行数,然后得到平均值。
在 pandas(或任何表格框架)中,我可以执行以下操作:
df.groupby(['device','session']).size().mean()
我试图在一个度量中复制这个逻辑:
avg_sessions = AVERAGE(
COUNTROWS(
GROUPBY(
df,
df[device],
df[session]
)
)
)
但显然,GROUPBY 不能被AVERAGE 包裹:
参数类型不正确。
【问题讨论】: