【发布时间】:2020-07-26 11:43:39
【问题描述】:
我有一个包含 50 个数字列和 10 个分类列的数据框。
df = C1 C2 .. C10 N1 N2 ... N50
a b c 2 3 1
我想删除所有异常值,但仅限于列 N1,N2,N6,N8,N10。
这意味着我不想在任何列中保留所有不是异常值的数据。
最好的方法是什么?
【问题讨论】:
-
异常值是什么意思?
-
@YOBEN_S 假设高于/低于平均值 3 个标准
-
@M-Wi 否,因为我只想按列的子组过滤
-
该线程上的至少一些答案涉及指定过滤列。
标签: python pandas data-science outliers