英特尔的 CLWB 指令使缓存行无效

Ana*_*ani 8 x86 intel cpu-architecture cpu-cache persistent-memory

我正在尝试为英特尔的clwb指令找到不会使缓存行无效的配置或内存访问模式。我正在使用 NVDIMM 对 Intel Xeon Gold 5218 处理器进行测试。Linux 版本是 5.4.0-3-amd64。我尝试使用 Device?DAX 模式并直接将此字符设备映射到地址空间。我还尝试将此非易失性内存添加为新的 NUMA 节点,并使用numactl --membind命令将内存绑定到它。在这两种情况下,当我使用clwb缓存地址时,它都会被驱逐。我正在观察 PAPI 硬件计数器的驱逐,并禁用预取器。

这是我正在测试的一个简单循环。array 和 tmp 变量,都被声明为 volatile,所以加载是真正执行的。

for(int i=0; i < arr_size; i++){
    tmp = array[i];
    _mm_clwb(& array[i]);
    _mm_mfence();
    tmp = array[i];    
}
Run Code Online (Sandbox Code Playgroud)

两次读取都会导致缓存未命中。

我想知道是否还有其他人试图检测是否有某种配置或内存访问模式会在缓存中留下缓存行?

Had*_*ais 4

clwb行为类似于clflushoptSKX 和 CSL。然而,在这些处理器上使用的程序clwb在支持优化实现的未来进程上运行时将自动受益clwb

clwb保留 ICL 上的高速缓存行。

请注意,来自InstLatx64cpuid的叶 0x7 信息表示 ICL 不支持,这是不正确的。clwb

clwbZen 2 也支持,但我不知道它在这个微架构上如何工作。