【发布时间】:2020-10-07 22:59:21
【问题描述】:
有人要求我测量一个在多 CPU 系统上求解微分方程的 fortran 程序的性能。我的雇主坚持要我测量 FLOP/s(每秒浮动操作)并将结果与基准进行比较(LINPACK),但我不相信这是要走的路,因为没有人能向我解释什么是 FLOP .
我对 FLOP 到底是什么进行了一些研究,得到了一些非常矛盾的答案。我得到的最受欢迎的答案之一是“1 FLOP = 加法和乘法运算”。真的吗?如果是这样,那么在物理上,这究竟意味着什么?
无论我最终使用什么方法,它都必须是可扩展的。某些版本的代码解决了具有数百万个未知数的系统,并且需要数天才能执行。
在我的案例中,还有哪些其他有效的衡量性能的方法(我的案例总结是“fortran 代码在数百个 CPU 上反复进行数天的大量算术计算)?
【问题讨论】:
标签: performance benchmarking flops