【发布时间】:2017-11-01 22:47:56
【问题描述】:
我正在将 csvs 读入 Spark,并将架构设置为所有 DecimalType(10,0) 列。当我查询数据时,我收到以下错误:
NumberFormatException: Infinite or NaN
如果我的数据框中有 NaN/null/infinite 值,我想将它们设置为 0。我该怎么做?这就是我尝试加载数据的方式:
var cases = spark.read.option("header",false).
option("nanValue","0").
option("nullValue","0").
option("positiveInf","0").
option("negativeInf","0").
schema(schema).
csv(...
任何帮助将不胜感激。
【问题讨论】:
标签: scala apache-spark apache-spark-sql bigdata