【发布时间】:2019-04-03 10:51:11
【问题描述】:
我有几个文件夹 - 3 个包含类似的 csv(同名)。 这些 csv 捕获了每个数据周期和流失周期组合与因变量的相关性,如下所示:
Data Period Jan'18
Churn Period Feb'18
Variable_Name correlation
Pending_Disconnect 0.553395448
status_Active 0.539464806
days_active 0.414774231
days_pend_disco 0.392915837
prop_tenure 0.074321692
abs_change_3m 0.062267386
因此,从 3 个文件夹中,3 个不同内容但具有相同名称的 csv 被整理到一个工作簿中,如下所示:
Data Period Jan'18 Data Period Jan'18 Data Period Jan'18
Churn Period Feb'18 Churn Period Mar'18 Churn Period Apr'18
Variable_Name correlation Variable_Name correlation Variable_Name correlation
Pending_Disconnect 0.553395448 Pending_Change 0.043461995 active_frq_N 0.025697016
status_Active 0.539464806 status_Active 0.038057697 active_frq_Y 0.025697016
days_active 0.414774231 ethnic 0.037503202 ethnic 0.025195149
days_pend_disco 0.392915837 days_active 0.037227245 ecgroup 0.023192408
prop_tenure 0.074321692 archetype_grp 0.035761434 age 0.023121305
abs_change_3m 0.062267386 age_nan 0.035761434 archetype_nan 0.023121305
目标是比较相关性如何逐月变化。
如何从不同的文件夹中提取 csv,并使用 python 将它们整理到 Excel 中的工作簿中? 目前我手动将每个 csv 的内容粘贴到 excel 表中并创建报告,但我需要自动执行此操作。
有人可以帮我解决这个问题吗?
文件夹结构如下:
操作后excel表格应如下所示:
【问题讨论】:
-
看看熊猫。它可以轻松读取您的 csv 文件并以您喜欢的任何格式写入新文件
标签: python excel pandas automation