【发布时间】:2021-08-22 20:49:01
【问题描述】:
我阅读了一个 csv 文件,我想删除重复的条目。 当我运行命令来执行此操作时,它会创建一个包含列号的新第一行和一个包含行号的新列。 见 为什么会这样?我应该如何解决这个问题?
def remove_duplicates(file):
df = pd.read_csv(file, encoding="latin-1", header = None)
Helper.printline(f"Rows in file {file}: {df.shape[0]}")
df.drop_duplicates(keep='first', inplace=True)
Helper.printline(f"Rows in file {file} with duplicates removed: {df.shape[0]}")
df.to_csv(file)
【问题讨论】:
标签: python python-3.x pandas csv