【问题标题】:Does glob work with pdf files?glob 可以处理 pdf 文件吗?
【发布时间】:2017-12-05 18:01:05
【问题描述】:

我是 python 新手,我正在尝试创建一个代码来搜索数千个 pdf 文件,这些文件由 3 个不同的数字、城镇、范围和部分组织和标题(文件看起来像:07N06E08_4200)。我一直在尝试让 glob 读取我的 pdf 文件,因为我已经将 glob 用于 excel 文件,但我没有任何运气。

这是目前引入数据的命令: glob.glob('./C:/Users/green_000/Documents/Alyssa/Python/FinalProject/Python_Data/SacramentoCounty')

然后返回:[]

然后我有:

collectData=[] 

for filename in glob.glob('./C:/Users/green_000/Documents/Alyssa/Python/FinalProject/Python_Data/SacramentoCounty'): 
print('processing {:s}'.format(filename))
data = pd.read_pdf(filename) 
collectData.append(data) 
AllData = pd.concat(collectData)
AllData.columns=['Township','Range','Section'] 
AllData.to_pdf('AllData.csv',mode='w')

我得到错误:没有要连接的对象

感谢您的帮助!

【问题讨论】:

    标签: python pdf concatenation glob


    【解决方案1】:

    您的路径表示您正在搜索相对路径(以. 开头)和绝对路径(以C: 开头)。你不能同时做这两件事。

    试试:

    for filename in glob.glob('C:/Users/green_000/Documents/Alyssa/Python/FinalProject/Python_Data/SacramentoCounty'): 
    

    【讨论】:

    • 当然,如果你可以在类似 UNIX 的环境中运行,./C:/foo 是合法路径,但我怀疑你是。
    猜你喜欢
    • 1970-01-01
    • 2016-12-08
    • 1970-01-01
    • 2016-09-02
    • 1970-01-01
    • 1970-01-01
    • 2020-05-02
    • 2011-05-17
    • 1970-01-01
    相关资源
    最近更新 更多