【发布时间】:2020-03-16 18:50:07
【问题描述】:
我正在使用 Python spark 将数据帧写入 blob 中的文件夹,该文件夹将保存为部分文件:
df.write.format("json").save("/mnt/path/DataModel")
文件保存为:
我正在使用以下代码将其合并到一个文件中:
#Read Part files
path = glob.glob("/dbfs/mnt/path/DataModel/part-000*.json")
#Move file to FinalData folder in blbo
for file in path:
shutil.move(file,"/dbfs/mnt/path/FinalData/FinalData.json")
但是FinalData.Json只有最后一部分文件数据,没有全部数据 部分文件。
【问题讨论】:
标签: python azure apache-spark databricks azure-databricks