【发布时间】:2021-01-20 06:44:51
【问题描述】:
我是 pyspark 的新手。我正在使用数据块运行 pyspark。我的数据存储在 Azure Data Lake Service 中。我正在尝试将 csv 文件从 ADLS 读取到 pyspark 数据框。所以我写了以下代码
import pyspark
from pyspark import SparkContext
from pyspark import SparkFiles
df = sqlContext.read.csv(SparkFiles.get("dbfs:mycsv path in ADSL/Data.csv"),
header=True, inferSchema= True)
但我收到错误消息
Py4JJavaError: An error occurred while calling o389.csv.
你能建议我纠正这个错误吗?
【问题讨论】:
标签: apache-spark pyspark databricks