【发布时间】:2020-12-09 19:24:50
【问题描述】:
我在多个子文件夹中有名为“toyexample”的 csv 文件。我想在所有子文件夹中附加所有名为 toyexample 的 csv 文件。
路径文件夹如下:
C:/Users/xxx/Dropbox/College/Project1/2005Q1/
C:/Users/xxx/Dropbox/College/Project1/2005Q2/
.....
.....
C:/Users/xxx/Dropbox/College/Project1/2015Q3/
C:/Users/xxx/Dropbox/College/Project1/2015Q4/
因此,路径子文件夹的范围从 2005Q1 到 2015Q4。
这些子文件夹中的每一个都有许多 csv 文件,但我只想提取一个名为 toyexample 的文件。
我正在尝试以下方法:
import pandas as pd
import os
path = ["subfolder1", "folder2", ....."subfolder44"]
appended_file = []
subpaths = os.listdir(path)
for pa in subpaths:
df = pd.read_csv("toyexample")
appended_file.append(df)
我想知道如何自动化从这么多不同目录读取文件的过程,而不是自己手动输入它们。我还需要帮助来阅读文件(可能使用os.path_join())并将它们附加到一个数据帧df
【问题讨论】:
标签: python python-3.x pandas csv