【发布时间】:2020-11-20 22:52:30
【问题描述】:
我正在使用 icc 编译以下循环
for (int i = 0; i < arrays_size; ++i) {
total = total + C[i];
}
矢量化报告说这个循环已经被矢量化了,但我不明白这是怎么可能的,因为存在明显的读写依赖性。
报告输出如下:
LOOP BEGIN at loops.cpp(46,5)
remark #15388: vectorization support: reference C has aligned access [ loops.cpp(47,7) ]
remark #15305: vectorization support: vector length 4
remark #15399: vectorization support: unroll factor set to 8
remark #15309: vectorization support: normalized vectorization overhead 0.475
remark #15300: LOOP WAS VECTORIZED
remark #15448: unmasked aligned unit stride loads: 1
remark #15475: --- begin vector loop cost summary ---
remark #15476: scalar loop cost: 5
remark #15477: vector loop cost: 1.250
remark #15478: estimated potential speedup: 3.990
remark #15488: --- end vector loop cost summary ---
remark #25015: Estimate of max trip count of loop=31250
LOOP END
有人能解释一下这是什么意思吗?如何矢量化这个循环?
【问题讨论】:
标签: compilation vectorization compiler-optimization