【发布时间】:2011-10-24 05:58:20
【问题描述】:
我想在英特尔的 SSE 上迈出第一步,所以我按照发布的指南 here 987654322@ 但posix_memalign)。
我还在不使用 SSE 扩展的情况下实现了一种计算密集型方法。令人惊讶的是,当我运行程序时,两段代码(带有 SSE 和没有 SSE 的一段)都需要相似的时间来运行,通常是使用 SSE 的时间略高于另一段。
这正常吗? GCC 是否可能已经使用 SSE 进行了优化(也使用 -O0 选项)?我也试过-mfpmath=387选项,但没办法,还是一样。
【问题讨论】:
-
你用的是什么CPU?
-
我使用的是 Intel Core i7 M640 2.80GHz
-
好的 - 请参阅下面的答案,您可能还想发布您的代码和用于构建它的命令行。