【发布时间】:2019-07-10 10:37:59
【问题描述】:
我正在使用以下代码将数据框写入 CSV:
df.write.format("csv").save(base_path+"avg.csv")
当我在客户端模式下运行 spark 时,上面 sn-ps 创建了一个文件夹名称 avg.csv 并且该文件夹包含一些带有 part-* 的文件 .csv 在我的工作节点或嵌套文件夹上,然后文件 part-*.csv。
现在当我尝试读取 avg.csv 时,我发现路径不存在。
df.read.format("com.databricks.spark.csv").load(base_path+"avg.csv")
谁能告诉我哪里做错了?
【问题讨论】:
标签: python csv apache-spark dataframe pyspark