【问题标题】:update excel files via python通过python更新excel文件
【发布时间】:2020-05-06 14:11:40
【问题描述】:

我想读取一个excel文件,对行进行排序,删除重复文件并再次重新保存文件

为此,我编写了以下脚本:

import pandas as pd

data = pd.ExcelFile('FILE_NAME.xlsx')
df = data.parse('data')
df.sort_index()
df.drop_duplicates(subset = 'MAKAT', keep='first', inplace=False)
data.close()
print(pd.read_excel(data))
print('**** DONE ****')

在结果中,我看到了屏幕上的行,但文件保留了重复的行。

我的问题是如何将这些更改保存到同一个文件中?

【问题讨论】:

    标签: python-3.x excel pandas


    【解决方案1】:

    将这两行改成如下:

    df = df.sort_index()
    df = df.drop_duplicates(subset = 'MAKAT', keep='first').sort_values(by=['MAKAT'])
    df.to_csv('outputfile.csv)
    

    【讨论】:

    • 它不起作用...文件仍然有重复的行。我需要删除重复项,按“MAKAT”排序并保存到同一个文件..
    猜你喜欢
    • 2020-07-01
    • 1970-01-01
    • 1970-01-01
    • 2012-05-09
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-11-21
    相关资源
    最近更新 更多