【发布时间】:2019-08-08 16:59:08
【问题描述】:
我的用例是读取一个现有的 json-schema 文件,解析这个 json-schema 文件并从中构建一个 Spark DataFrame 模式。首先,我按照here 中提到的步骤操作。
遵循的步骤
1.从Maven导入库
2.重启集群
3.创建了一个示例 JSON 模式文件
4.使用此代码读取示例模式文件val schema = SchemaConverter.convert("/FileStore/tables/schemaFile.json")
当我运行上面的命令时,我得到error: not found: value SchemaConverter
为了确保调用库,我在重新启动集群后将笔记本重新附加到集群。
除了尝试上述方法之外,我还尝试了以下方法。我用实际的 JSON 模式替换了 jsonString。
import org.apache.spark.sql.types.{DataType, StructType}
val newSchema = DataType.fromJson(jsonString).asInstanceOf[StructType]
我一直在使用的示例模式有 300 多个 feild,为简单起见,我使用了来自 here 的示例模式。
【问题讨论】:
标签: scala apache-spark databricks