【发布时间】:2017-03-31 16:25:50
【问题描述】:
我很好奇,当我在我的 Spark 程序中对一堆小数进行任何类型的数学运算时,预先对数字进行四舍五入有什么不同吗?例如:
3.000009481 * 10.90001001010
同时计算类似的时间:
3.000 * 10.900
乘法、除法和更高级的东西(如幂和平方根等)是否有所不同?
我想知道,因为当您对数百万个数字执行此操作时,可以说它只有几分之一毫秒,四舍五入有意义吗?或者你总是会得到相同的小数计算时间?
我有一个大型的 aggregateByKey 函数,它正在执行大量计算。我所在的集群始终提供不一致的性能指标。
【问题讨论】:
标签: performance scala apache-spark