【发布时间】:2023-01-05 18:35:56
【问题描述】:
在使用 Pyspark unionByName 文档中的这些代码行时
df =spark.createDataFrame(data,columns)
df1 = spark.createDataFrame([[1, 2, 3]], ["col0", "col1", "col2"])
df2 = spark.createDataFrame([[4, 5, 6]], ["col1", "col2", "col3"])
df1.unionByName(df2, allowMissingColumns=True).show()
收到此错误:
unionByName() got an unexpected keyword argument 'allowMissingColumns'
Traceback (most recent call last):
TypeError: unionByName() got an unexpected keyword argument 'allowMissingColumns'
在我的代码中还有其他方法可以做到这一点
df1: ["col0", "col1", "col2","col3"]
df2: ["col1", "col2"]
我想在 ["col1", "col2"] 上合并它们,并期望 col0 和 col3 在 union 之后为空。
【问题讨论】:
-
您使用的是什么版本?请注意,allowMissingColumn 从版本 3.1.0 开始可用。
-
对我来说效果很好,请检查您使用的版本是否正确
-
是的,我使用的是 2.4 版 我怎样才能实现相同的功能,有没有解决方法
标签: python python-3.x apache-spark pyspark apache-spark-sql