【发布时间】:2019-12-24 04:15:47
【问题描述】:
在给定的数据框中,我有这两列:
neighbourhood_group
price
价格列包含所有neighbourhood_group的所有价格:
neighbourhood_group price
0 Brooklyn 149
1 Manhattan 225
2 Manhattan 150
3 Brooklyn 89
4 Manhattan 80
5 Manhattan 200
6 Brooklyn 60
7 Manhattan 79
8 Manhattan 79
9 Manhattan 150
我正在尝试检测每个 neighbourhood_group 的异常值。
到目前为止,我想到的唯一想法是按 neighbourhood_group 按价格分组,检测每个组中的异常值并为需要删除的行创建掩码。
data.groupby('neighbourhood_group')['price']
我怀疑可能有更简单的解决方案。
【问题讨论】:
-
在这种情况下,您的值都不是异常值,对吧?