【发布时间】:2019-08-09 05:06:22
【问题描述】:
我有一个非常大的 CSV 文件,其中包含 250,000 多条记录,需要一段时间才能在 Excel 中进行任何分析,因此我想根据我在 pandas 中创建的特定计算列将其拼接到多个工作表中。
特定列称为“Period”,是我的数据框中的字符串变量,格式为 MMM_YYYY(例如,Jan_2016、Feb_2016 等)
我正在尝试制作一些具有工作簿的东西(我们称之为 data_by_month.xlsx)在数据框列“Period”中的每个唯一时期都有一个工作表,所有匹配的行都写入相应的工作表中。
这是我尝试过的逻辑:
for row in df:
for period in unique_periods:
if row[38] == period:
with pd.ExcelWriter("data_by_month.xslx") as writer:
df.to_excel(writer, sheet_name = period)
这背后的想法是对于数据帧中的每一行,遍历唯一周期列表中的每个周期,如果 row[38](即 Period 的索引)等于一个周期,则写将其放入 data_by_month.xlsx 工作簿中,放入特定的工作表中。
我知道我的代码现在完全不正确,但这是我一直在尝试实现的一般逻辑。我很确定我指的是数据框中“期间”列的位置不正确,因为它一直说它超出了范围。欢迎任何建议!
非常感谢!
【问题讨论】:
-
您能否发布几行 CSV。没有截图,纯文本复制粘贴。