【问题标题】:Python Pandas drop_duplicates - adds a new column and row to my data framePython Pandas drop_duplicates - 向我的数据框添加新的列和行
【发布时间】:2021-08-22 20:49:01
【问题描述】:

我阅读了一个 csv 文件,我想删除重复的条目。 当我运行命令来执行此操作时,它会创建一个包含列号的新第一行和一个包含行号的新列。 见 为什么会这样?我应该如何解决这个问题?

def remove_duplicates(file):
    df = pd.read_csv(file, encoding="latin-1", header = None)
    Helper.printline(f"Rows in file {file}: {df.shape[0]}")
    df.drop_duplicates(keep='first', inplace=True)
    Helper.printline(f"Rows in file {file} with duplicates removed: {df.shape[0]}")
    df.to_csv(file)

【问题讨论】:

    标签: python python-3.x pandas csv


    【解决方案1】:

    使用df.to_csv(file, header=False, index=False) 保存不带标题和索引的 .csv 文件。

    【讨论】:

      猜你喜欢
      • 2014-05-04
      • 2021-06-20
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2023-03-22
      • 2020-10-13
      • 1970-01-01
      • 2018-10-09
      相关资源
      最近更新 更多