MOVNTPS

使用非时间提示存储 打包单精度浮点值

stableVMJITAOTinstruction

编码

操作码指令Op/En64 位兼容/传统说明
NP 0F 2B /rMOVNTPS m128, xmm1A有效有效使用非时空提示将打包的单精度值 xmm1 移动到 mem 。
VEX.128.0F.WIG 2B /rVMOVNTPS m128, xmm1A有效有效使用非时空提示将打包的单精度值 xmm1 移动到 mem 。
VEX.256.0F.WIG 2B /rVMOVNTPS m256, ymm1A有效有效使用非时空提示将打包的单精度值 ymm1 移动到 mem 。
EVEX.128.0F.W0 2B /rVMOVNTPS m128, xmm1B有效有效使用非时空提示将 xmm1 中打包的单精度值移动到 m128 AVX512F) OR AVX10.1 中.
EVEX.256.0F.W0 2B /rVMOVNTPS m256, ymm1B有效有效使用非时空提示将 ymm1 中打包的单精度值移动到 m256 AVX512F) OR AVX10.1 中.
EVEX.512.0F.W0 2B /rVMOVNTPS m512, zmm1 Op/En Tuple Type A N/A B Full MemB有效有效使用非时空提示将 zmm1 中打包的单精度值移动到 m512 Instruction OR AVX10.1 ction 操作数 Encoding1 中. O perand 1 操作数 2 操作数 3 操作数 4 ModRM: r/m (w) ModRM:reg (r) N/A ModRM: r/m (w) ModRM:reg (r) N/A N/A N/A ModRM:

操作数编码

每个模式对应上表 Op/En 列的一个取值,说明各操作数按书写顺序分别编码在指令的哪个字段,以及指令对它是读、是写还是两者兼有。

A

  1. modrm.rm escrituraModRM 字节的 r/m 字段(第 2-0 位);当 mod 字段要求时,还包括 SIB 字节和位移
  2. modrm.reg lecturaModRM 字节的 reg 字段(第 5-3 位)

B

  1. modrm.rm escrituraModRM 字节的 r/m 字段(第 2-0 位);当 mod 字段要求时,还包括 SIB 字节和位移
  2. modrm.reg lecturaModRM 字节的 reg 字段(第 5-3 位)

Tupla: Full Mem

实测开销

正在从 arch-data 加载实测数据...

说明

将 源操作数(第二操作数)中的 打包单精度浮点值 移动到 目标操作数(第一操作数) ,使用非时空提示来防止在写入内存时对数据进行缓存. 源操作数是一个XMM的寄存器,YMM寄存器或ZMM寄存器,该寄存器被假定包含包装的单精度,浮点. 目标操作数是一个128位,256位或512位的内存位置. 内存操作数必须在16字节(128位版本),32字节(VEX.256编码版本)或64字节(EVEX.512编码版本)的边界上对齐,否则将生成一个一般保护例外(#GP).

非时空提示是通过在将数据写入内存时使用结合(WC)内存类型协议的写法来实现的. 使用此协议,处理器不会将数据写入缓存层级,也不会将相应的缓存行从内存中提取到缓存层级中. 如果为非时空存储指定的内存地址位于不可切换的(UC)或写入受保护的(WP)内存区域,被写入区域的内存类型可以覆盖非时空提示. 关于非时空商店的更多信息,见"Caching of Temperal vs. 非时空数据"在IA-32 Intel架构软件开发者手册第10章第1卷.

由于WC协议使用一种命令不严的内存一致性模型,如果多个处理器可能使用不同的内存类型来读写/写入目的地内存位置,那么与SFENCE或MFENCE指令一起执行的栅栏操作应当与MOVNTPS指令一起使用.

说明: VEX.vvvv和EVEX.vvvv是保留的,必须是1111b,否则指令会#UD.

行动

VMOVNTPS (EVEX Encoded Versions)
VL = 128, 256, 512
DEST[VL-1:0] := SRC[VL-1:0]
DEST[MAXVL-1:VL] := 0

1. ModRM.MOD != 011B


MOVNTPS
DEST := SRC

Intel C/C++ 内在编译器

VMOVNTPS void _mm512_stream_ps(float * p, __m512d a);
MOVNTPS void _mm_stream_ps (float * p, __m128d a);
VMOVNTPS void _mm256_stream_ps (float * p, __m256 a);

SIMD 浮点 例外

None.

其他例外

非EVEX-encoded 指令,参见表2-18中的例外类型1. SSE,"第1类例外条件".

EVEX-encoded discription,参见表2-47,"Type E1NF 类例外条件".

Additionally:

#UD               If VEX.vvvv != 1111B or EVEX.vvvv != 1111B.

来源