【发布时间】:2018-09-26 17:38:44
【问题描述】:
我目前正在进行一些优化并比较 DSP 应用程序的矢量化可能性,这似乎是 AVX512 的理想选择,因为这些只是简单的不相关数组处理循环。但是在新的 i9 上,与 AVX2 相比,使用 AVX512 时我没有测量到任何合理的改进。任何指针?有什么好的结果吗? (顺便说一句。我试过 MSVC/CLANG/ICL,没有明显区别,很多时候 AVX512 代码实际上似乎更慢)
【问题讨论】:
标签: performance x86 micro-optimization avx2 avx512