【发布时间】:2015-04-28 09:19:30
【问题描述】:
对于带有
的表create table mytable (
..
)
partitioned by (my_part_column String)
我们正在执行一个hive sql如下:
from pyspark.sql import HiveContext
hc = HiveContext(sc)
data = hc.sql("select * from my_table limit 10")
读回的值将“my_part_columns”显示为每一行的第一个项目,而不是最后一个。
【问题讨论】:
标签: hive apache-spark parquet