【发布时间】:2023-02-21 17:18:04
【问题描述】:
执行此操作时提到的所有方法似乎都提供了一个文件夹,而不是可以读取到 pandas 数据框的单个 .csv 文件。
【问题讨论】:
-
您的 spark 数据框很大吗?
执行此操作时提到的所有方法似乎都提供了一个文件夹,而不是可以读取到 pandas 数据框的单个 .csv 文件。
【问题讨论】:
如果您的 PySpark 数据框不是那么大,您可以简单地将其转换为 Pandas 数据框,然后将其保存到磁盘:
# type(df) -> pyspark.sql.dataframe.DataFrame
df.toPandas.to_csv('out.csv')
但是,如果它很大,则无法将其加载到 Pandas 数据框中。
【讨论】: