【发布时间】:2018-11-20 16:36:46
【问题描述】:
如何将函数应用于我已构建的文件路径列表,并在同一路径中写入输出 csv?
读取子文件夹中的文件 -> 执行功能 -> 写入子文件夹中的文件 子文件夹 -> 转到下一个子文件夹
#opened xml by filename
with open(r'XML_opsReport 100001.xml', encoding = "utf8") as fd:
Odict_parsedFromFilePath = xmltodict.parse(fd.read())
#func called in func below
def activity_to_df_one_day (list_activity_this_day):
ib_list = [pd.DataFrame(list_activity_this_day[i], columns=list_activity_this_day[i].keys()).drop("@uom") for i in range(len(list_activity_this_day))]
return pd.concat(ib_list)
#Processes parsed xml and writes csv
def activity_to_df_all_days (Odict_parsedFromFilePath, subdir): #writes csv from parsed xml after some processing
nodes_reports = Odict_parsedFromFilePath['opsReports']['opsReport']
list_activity = []
for i in range(len(nodes_reports)):
try:
df = activity_to_df_one_day(nodes_reports[i]['activity'])
list_activity.append(df)
except KeyError:
continue
opsReport = pd.concat(list_activity)
opsReport['dTimStart'] = pd.to_datetime(opsReport['dTimStart'], infer_datetime_format =True)
opsReport.sort_values('dTimStart', axis=0, ascending=True, inplace=True, kind='quicksort', na_position='last')
opsReport.to_csv("subdir\opsReport.csv") #write to the subdir
def scanfolder(): #fetches list of file-paths with desired starting name.
list_files = []
for path, dirs, files in os.walk(r'C:\..\xml_objects'): #directory containing several subfolders
for f in files:
if f.startswith('XML_opsReport'):
list_files.append(os.path.join(path, f))
return list_files
filepaths = scanfolder() #list of file-paths
每个功能都很好,xml处理好,所以我不分享xml结构。 filepaths 中有 100 多个路径,每个路径都有不同的子目录。我希望将来也能够应用上述流程,在那里我可以获得文件路径并执行所需的操作。将 csv 文件写入其子目录很重要。
【问题讨论】:
-
我不太清楚你的要求是什么;这有帮助吗? stackoverflow.com/questions/35315873/…
-
我能解决
-
您可以发布自己的解决方案并接受它。
标签: python-3.x pandas os.path