【发布时间】:2012-04-23 23:15:29
【问题描述】:
有人可以举例说明 map reduce 中中位数/分位数的计算吗?
我对 Datafu 的中位数的理解是,'n' 个映射器对 数据并将数据发送到负责排序的“1”reducer 来自 n 个映射器的所有数据并找到中值(中间值) 我的理解正确吗?,
如果是这样,这种方法是否适用于 大量数据,我可以清楚地看到一个减速器 努力完成最后的任务。 谢谢
【问题讨论】:
标签: hadoop statistics mapreduce apache-pig median