【发布时间】:2020-03-21 17:18:20
【问题描述】:
当我将数据框写入现有位置而不指定保存模式时,它会返回错误
df.write.partitionBy("column").option("path", <EXISTING PATH>).format("parquet").save
但是,当我使用 saveAsTable 选项执行相同的命令时,如果表不存在,Spark 似乎会覆盖数据。
df.write.partitionBy("column").option("path", <EXISTING PATH>).format("parquet").saveAsTable(<NEW_TABLE>)
谁能解释一下这个逻辑。引擎盖下到底发生了什么?
我正在研究 Databricks。
编辑
根据 Aravind 的评论,我将缺少的 save 方法添加到第一个 sn-p 中。
【问题讨论】:
标签: scala dataframe apache-spark parquet azure-databricks