【发布时间】:2018-06-07 14:30:00
【问题描述】:
我有一个 snappy.parquet 文件,我想通过 impala 或 beeline 将其整体移动到一个表中,通过以下方式创建一个表
CREATE EXTERNAL TABLE IF NOT EXISTS first_test LIKE PARQUET '/user/my_user/my_table/part-00000-c0544fc8-b709-4408-8e90-f0f9e4050691-c000.snappy.parquet'
由于某种原因无法正常工作,因为它说Fetched 0 row(s) in 0.31s.
当我通过 spark.read.parquet 在 spark 中读取此文件时,它会返回我正在查找的表(超过 1000 行)。
我无法直接写入 Hive,因为我没有 myDF.write.saveAsTable 的权限。
有没有办法通过 impala 或 beeline 制作表格,即使 impala 和 beeline 在 hdfs 中只有读取和执行权限而没有写入权限。或者我是否也必须授予 impala 和 beeline 写入 hdfs 的权限?
【问题讨论】:
标签: apache-spark hdfs impala beeline