【发布时间】:2020-06-18 13:55:12
【问题描述】:
我有一个包含多个 csv 文件的文件夹,文件名在 100 到 400 之间(例如 142.csv、278.csv 等)。并非所有介于 100-400 之间的数字都与文件相关联,例如没有 143.csv。我想编写一个循环,将 5 个随机文件导入到 pandas 中的单独数据帧中,而不是一遍又一遍地手动搜索和输入文件名。有什么想法可以让我开始吗?
【问题讨论】:
-
将所有文件名加载到一个数组中。从该数组中随机选择一个名称并加载?
-
使用
files =glob.glob和numpy.random.choice(files, 5) -
@QuangHoang,这就是我尝试过的,但无法找出导致我出现问题的简单语法错误。谢谢!
-
@ChrisA,我对 glob 不熟悉,我会查一下。感谢您为我指明正确的方向!
标签: pandas data-science data-analysis