【发布时间】:2019-03-07 07:35:45
【问题描述】:
根据MKL的documentation:
?gemm3m 例程执行矩阵-矩阵运算 复杂的矩阵。这些例程类似于 ?gemm 例程, 但它们使用的矩阵乘法运算较少。
和
这些例程通过形成 输入矩阵的实部和虚部。这使用了三个真实的 矩阵乘法和五个实数矩阵加法,而不是 常规四实矩阵乘法和二实矩阵 补充。使用三个实数矩阵乘法减少了 在矩阵运算上花费的时间减少了 25%,从而显着 节省大型矩阵的计算时间。
如果是这样,为什么不弃用 Zgemm?这里有什么问题?使用 Zgemm 会更好吗? gemm3m 的批处理版本也存在,这意味着它对小型矩阵也很有用。
【问题讨论】:
标签: linear-algebra blas intel-mkl