【发布时间】:2020-05-27 16:53:25
【问题描述】:
我正在使用 saveAsTable 方法保存 Spark DataFrame 并编写以下代码。
val options = Map("path" -> hiveTablePath)
df.write.format("orc")
.partitionBy("partitioncolumn")
.options(options)
.mode(SaveMode.Append)
.saveAsTable(hiveTable)
它工作正常,我可以在 hive 表中看到数据。但是当我使用另一个属性 bucketby(5,bucketted_column)
df.write.format("orc")
.partitionBy("partitioncolumn")
.bucketby(5,bucketted_column)
.options(options)
.mode(SaveMode.Append)
.saveAsTable(hiveTable)
它试图将其保存在 spark 'default' 数据库而不是 hive 数据库中。
有人可以建议我为什么 bucketby(5,bucketted_column) 不能与 saveAsTable 一起使用。
Note: Framework: HDP 3.0
Spark : 2.1
【问题讨论】:
-
如果我没记错的话,默认也是 Hive
标签: apache-spark apache-spark-sql hdp