【发布时间】:2019-11-02 17:07:46
【问题描述】:
我正在尝试使用 drop_duplicates(subset=[''], keep=False) 在我的数据框中删除重复项。显然它在我的 Jupyter Notebook 中工作正常,但是当我尝试通过终端作为 .py 文件执行时,我收到以下错误:
Traceback (most recent call last):
File "/home/source/fork/PySpark_Analytics/Notebooks/Krish/beryllium_pandas.py", line 54, in <module>
dffsamelname = dffsameflname.drop_duplicates(subset=['INDIVIDUAL_LASTNAME'], keep=False)
File "/var/webeng/opensource/aetna-anaconda/lib/python2.7/site-packages/pandas/util/decorators.py", line 88, in wrapper
return func(*args, **kwargs)
TypeError: drop_duplicates() got an unexpected keyword argument 'keep'
检查 pandas 版本 >0.18,因为当时引入了 keep = false。
# Trying to drop both the records with same last name
dffsamelname = dffsameflname.drop_duplicates(subset=['INDIVIDUAL_LASTNAME'], keep=False)
我想删除正在删除的两个记录。因此 keep=false 是必要的。
如果我删除 keep=false,它就可以正常工作。
【问题讨论】:
-
print(pd.__version__)的输出是什么 -
@Erfan: 0.22.0 是这个
标签: python pandas python-2.7 dataframe