【问题标题】:Merge dataframe from folder合并文件夹中的数据框
【发布时间】:2021-10-03 15:38:18
【问题描述】:

我正在尝试在 Python 中合并不同的 csv。这些文件位于同一文件夹中。所有文件都有一个共同的“client_ID”列。我试过这段代码:

path= r'/folder_path/'
allfiles = glob.glob(path + "/*.csv")
df = pd.DataFrame()

for file in allfiles:
    df_file = pd.read_csv(file)
    df_file = pd.merge(df, df_file, on='partner_id')
     
df

【问题讨论】:

  • df 没有partner_id
  • 不,df 为空
  • 你的错误是什么?你能把错误说出来吗?
  • KeyError: 'partner_id'
  • df 没有该列,您可以尝试类似df = pd.read_csv(allfiles[0]) 然后在for循环中for file in allfiles[1:]:

标签: python pandas dataframe merge


【解决方案1】:

您可以先读取第一个 csv 文件,以免从空数据框开始。我会像这样编辑您的代码:

path= r'/folder_path/'
allfiles = glob.glob(path + "/*.csv")

for i, file in enumerate(allfiles):
    if i < 1:
        df = pd.read_csv(file)
    else:
        df_file = pd.read_csv(file)
        df = pd.merge(df, df_file, on='partner_id')
 
df

【讨论】:

    猜你喜欢
    • 2021-10-03
    • 1970-01-01
    • 2021-09-18
    • 2022-12-06
    • 1970-01-01
    • 1970-01-01
    • 2020-12-06
    • 2018-03-30
    • 2017-03-11
    相关资源
    最近更新 更多