【发布时间】:2021-07-30 15:15:37
【问题描述】:
在编写专栏脚本时,我遇到了一些非常有趣的事情。我将 pd.DataFrame.isna 用于单列和多列有两种方式。当我在多个括号中编写脚本时,pd.df.isna 将整个代码返回给我。
override[override.ORIGINAL_CREDITOR_ID.notna()].shape
override[override[['ORIGINAL_CREDITOR_ID']].notna()].shape
所以第一行返回 3880 行并在 2.5 毫秒内运行,而第二行返回覆盖数据框中存在的所有行,这也需要 3.08 秒。 发生这种情况有什么原因吗?我如何避免这种情况,因为我必须使其可配置以在第二个查询中传递多个列?
【问题讨论】:
-
override.ORIGINAL_CREDITOR_ID是pandas.Series和override[['ORIGINAL_CREDITOR_ID']]是pandas.DataFrame
标签: python pandas numpy missing-data isnan