【发布时间】:2014-01-08 16:10:07
【问题描述】:
我有一个自定义的猪存储输入机制,它将一堆汇总统计值(如偏度、峰度、中位数等)放入元组中。具体来说,这些数字被假定为双精度数,因此双精度数被放置在元组中。
问题是,当 Java 端的偏度/峰度为 NaN 时,它们似乎映射到 Pig 中的 NaN,即使我已经定义了元组模式,我也无法弄清楚如何使用它们将它们作为“双”数据类型。
NaN 的排序似乎高于最高的双精度数,因此按降序排序似乎将所有 NaN 放在首位。我已经尝试通过“偏度不为空”进行过滤,但这不起作用。
文档和谷歌并没有告诉我太多关于如何使用这些值的信息。我需要能够处理这些数字。
谢谢!
【问题讨论】:
标签: hadoop double apache-pig nan