【发布时间】:2017-06-09 17:28:14
【问题描述】:
我按照this post 中的示例将DataFrame 作为csv 写入AWS S3 存储桶。结果不是一个文件,而是一个包含许多 .csv 文件的文件夹。我现在无法在 SparkR 中以 DataFrame 形式读取此文件夹。以下是我尝试过的,但它们不会导致我写出的 DataFrame 相同。
write.df(df, 's3a://bucket/df', source="csv") #Creates a folder named df in S3 bucket
df_in1 <- read.df("s3a://bucket/df", source="csv")
df_in2 <- read.df("s3a://bucket/df/*.csv", source="csv")
#Neither df_in1 or df_in2 result in DataFrames that are the same as df
【问题讨论】:
标签: sparkr databricks