【发布时间】:2022-01-19 19:54:03
【问题描述】:
我有一个具有以下架构的 Hive 表:
hive> desc <DB>.<TN>;
id int,
name varchar(10),
reg varchar(8);
当我尝试在 Spark (Pyspark shell) 上描述同一张表时,它会将 Varchar 转换为 String。
spark.sql("""describe <DB>.<TN>""").show()
id int
name string
reg string
我想在 Spark 上查询时保留 Hive 数据类型。意味着我期待 varchar 代替 String。有谁知道如何阻止 spark 推断自己的数据类型?
【问题讨论】:
标签: apache-spark pyspark