【发布时间】:2018-09-26 12:01:05
【问题描述】:
我在一个文件夹中有大约 150 个不同的工作簿 (xlsx),我想将它们读入 python 数据框进行分析。
每个工作簿都以相同的工作表名称和列名称进行设置。
我需要将每个工作簿的第一张表(“关键字排名”)上传到每个 DataFrame。对于读入的第一个工作表,我想从第 11 行开始维护列标题;之后的每个工作表我都想从第 12 行开始附加到我的 DataFrame。
我是 Python 新手,一直在网上阅读一些说明,但被卡住了。据我了解,我可以使用 xlrd 库来促进这一点。
我一直在玩下面的代码,但还没有走多远。 “关键字排名”是我要附加的工作表名称。
import pandas as pd
import numpy as np
import glob as glob
all_data = pd.DataFrame()
all_data = pd.ExcelFile("C:\\Users\\John Smith\\Documents\\Analysis\\FPR Nov - Mar 2018\\Dec_1_General.xlsx")
print(all_data.sheet_names)
all_d = all_data.parse('Keywords Rankings')
for f in glob.glob("Users\\John Smith\\Documents\\Analysis\\FPR Nov - Mar 2018\\*.xlsx", recursive=True):
df = pd.read_excel(f)
all_d = all_d.append(df,ignore_index=True)
【问题讨论】: