【发布时间】:2021-11-03 07:59:10
【问题描述】:
我正在使用以下代码使用 Azure 数据块读取 excel 文件:
dfSource = spark \
.read \
.format("com.crealytics.spark.excel") \
.option("Header", "true") \
.option("inferSchema", "true") \
.load(sSourcePath)#.withColumn("SourceFile",F.input_file_name())
但我收到以下错误:
PathNotFound 错误消息:openFileForRead 必须用于文件而不是目录
当我给出完整的文件名时,Spark 会正确读取文件。
注意:我想读取文件夹中存在的所有文件。
【问题讨论】:
-
你想对数据做什么?合并成一个数据框?
-
是的,我想将所有数据合并到一个数据帧中。
标签: python apache-spark pyspark databricks azure-databricks