【发布时间】:2020-03-21 17:29:21
【问题描述】:
为什么这种方法不起作用?
from pyspark.sql import SparkSession
spark = SparkSession.builder.appName('session').getOrCreate()
df = spark.range(5).toDF("index")
filepath = r"C:/my_favorite_directory"
df.write.csv(filepath)
更新
上面的代码工作正常,问题是我没有指定hadoop二进制路径来引用pyspark编写csv文件所需的winutils二进制文件。
【问题讨论】:
-
你能提供你得到的确切错误
-
为什么这种方法不起作用?会发生什么?
-
感谢您的回复。不幸的是,错误消息太长,无法放入问题的正文中(只允许 30k 个字符)
-
可以提供最后10-15行错误
标签: python pyspark export-to-csv