【发布时间】:2017-11-14 07:17:25
【问题描述】:
我有以下结构的 json 文件:
{"names":[{"name":"John","lastName":"Doe"},
{"name":"John","lastName":"Marcus"},
{"name":"David","lastName":"Luis"}
]}
我想读取几个这样的 json 文件,并根据名称中的“名称”列区分它们。 我试过了
df.dropDuplicates(Array("names.name"))
但它并没有发挥作用。
【问题讨论】:
-
从 json 文件创建数据框后,您的问题会重复:stackoverflow.com/questions/30248221/…
标签: scala apache-spark databricks