【发布时间】:2017-09-18 15:25:46
【问题描述】:
我有一个使用pyspark 读入的数据框:
df1 = spark.read.csv("/user/me/data/*").toPandas()
不幸的是,pyspark 将所有类型保留为Object,甚至是数值。我需要将它与我用df2 = pd.read_csv("file.csv") 读入的另一个数据框合并,所以我需要完全按照熊猫所做的那样推断df1 中的类型。
如何推断现有 pandas 数据框的类型?
【问题讨论】:
标签: python pandas apache-spark pyspark