【问题标题】:Using glob to parse through folders for files使用 glob 解析文件夹中的文件
【发布时间】:2021-07-26 00:51:16
【问题描述】:

我有以下来自 pandas 的示例数据集输出。

我想以一种有效的方式做的是使用 glob 仅在关联的主文件夹和子文件夹中搜索文件名,而不是按照我当前的代码循环遍历所有主文件夹/子文件夹。然后我需要它与我拥有的主文件夹和子文件夹匹配,如果匹配,则复制文件。我有有效的代码,但效率很低,每次搜索都必须遍历所有文件夹/子文件夹。代码如下;目前main_folder和searchdate是lists.filenames_i_want,也是我要匹配的列表。有什么办法可以让它直接进入文件夹/子文件夹,例如,如果我将其作为 CSV 输入提供?

import itertools
import glob
import shutil
from pathlib import Path

filenames_i_want = Search_param
main_folder=locosearch 
searchfolder= Search_date
TargetFolder = r'C:\ELK\LOGS\XX\DEST'
for directory,folder in itertools.product(main_folder, searchfolder):
    files = glob.glob('Z:/{}/{}/asts_data_logger/*.bz2'.format(directory, folder))
    for f in files:
        current_path = Path(f)
        cpn = current_path.name
        if  current_path.name in filenames_i_want:
            print(f"found target file: {f}")
            shutil.copy2(f, TargetFolder)

【问题讨论】:

  • 为什么需要使用“glob”?上面的数据集明确地标识了 9 个文件。无需搜索。为什么不一次一行地遍历行,然后连接三列?
  • 嘿@TimRoberts,感谢您的评论。看起来我已经使用 glob 将其复杂化了,可以只创建一个具有完整路径名的列,然后循环遍历它。感谢您对此的回复

标签: python glob


【解决方案1】:

我创建了一个列并使用字段创建绝对路径,然后使用元组遍历每一行并使用shutil进行复制

TargetFolder = r'C:\ELK\LOGS\ATH\DEST'
    for row in df.itertuples():
    search = row.Search
    try:
        shutil.copy2(search, TargetFolder)
        except Exception as e:
      print(e)

【讨论】:

    猜你喜欢
    • 2016-03-27
    • 1970-01-01
    • 2019-12-26
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-06-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多