【问题标题】:Importing a *random* csv file from a folder into pandas将文件夹中的 *random* csv 文件导入 pandas
【发布时间】:2020-06-18 13:55:12
【问题描述】:

我有一个包含多个 csv 文件的文件夹,文件名在 100 到 400 之间(例如 142.csv、278.csv 等)。并非所有介于 100-400 之间的数字都与文件相关联,例如没有 143.csv。我想编写一个循环,将 5 个随机文件导入到 pandas 中的单独数据帧中,而不是一遍又一遍地手动搜索和输入文件名。有什么想法可以让我开始吗?

【问题讨论】:

  • 将所有文件名加载到一个数组中。从该数组中随机选择一个名称并加载?
  • 使用files =glob.globnumpy.random.choice(files, 5)
  • @QuangHoang,这就是我尝试过的,但无法找出导致我出现问题的简单语法错误。谢谢!
  • @ChrisA,我对 glob 不熟悉,我会查一下。感谢您为我指明正确的方向!

标签: pandas data-science data-analysis


【解决方案1】:

您可以使用 glob 并读取目录中的所有 csv 文件。

file = glob.glob('*.csv')
random_files=np.random.choice(file,5)
dataframes= []
for fp in random_files :
    dataframes.append(pd.read_csv(fp))

您可以从目录中随机选择 5 个文件,然后分别读取它们。 希望我能回答你的问题

【讨论】:

    猜你喜欢
    • 2012-12-31
    • 2021-07-25
    • 1970-01-01
    • 1970-01-01
    • 2016-07-09
    • 2019-06-13
    • 2013-04-11
    • 1970-01-01
    相关资源
    最近更新 更多