【发布时间】:2015-03-25 19:52:26
【问题描述】:
我期待在我们的一个开源工具包中使用高斯核导数(最高 2/3 阶)对大型医学图像(512 x 512 x 1000 双倍)加速卷积。我们目前通过 FFT 进行这种卷积。
在朋友推荐了 ArrayFire 并阅读了这个post 之后,我想看看我是否可以采用这个工具包。尽管我目前只对 CUDA 感兴趣,因为这就是我手头的东西,这似乎是一项巨大的努力,并使我们能够处理多个后端。
我在论坛上读到了这个post,上面说 ArrayFire 中的卷积在特定内核大小之后切换到频域。我查看了 cuda 文件 convolve.cu,但我没有在 ArrayFire 或任何 cuFFT 内容中找到对 fft 的任何调用。我错过了什么吗?
接下来,我想直接在频域中构造高斯核的导数,与图像 FFT 相乘并将其返回。但是我想比较在空间和频率域中创建卷积核之间的速度提升。此外,ArrayFire 似乎没有 3D 高斯核。
【问题讨论】: