VSE64.V

RISC-V VSE64.V 指令详解

指令手册V-type

把 vs3 中的活动 64 位元素按单位步长存入 x[rs1] 开始的连续内存。

指令语法

vse64.v vs3, (rs1), vm
操作数说明
vs3:源向量寄存器组,提供活动元素的存储数据。
rs1:整数基址寄存器;单位步长形式写入连续地址。
vm:若语法包含 vm,vm=0 使用 v0 作为执行掩码,vm=1 为未掩码。
V向量内存向量存储

指令行为说明

VSE64.V 是 RISC-V V 扩展的 64 位单位步长向量存储指令。活动 body 元素把 vs3[i] 作为 64 位内存元素写到 x[rs1] + i * 8 字节的连续地址;vm=0 时由 v0.t 选择元素,掩码关闭元素不写内存。

VSE64.V 指令解析与执行动画

从编码字段解析 64 位单位步长存储,再逐元素计算 x[rs1] + i * 8。

输入的指令
vse64.v
执行环境:EEW=64,单位步长=8 字节,示例 SEW=64,LMUL=m1;这些不属于汇编语法操作数。
编码字段vse64.v / STORE-FP
31..29
nf
000
28
mew
0
27..26
mop
00
25
vm
0
24..20
sumop
00000
19..15
rs1
01010
14..12
width
111
11..7
vd/vs3
01000
6..0
opcode
0100111
地址与数据路径addr[i] = 0x8000 + i * 8
i=0
i=1
i=2
i=3
i=4
i=5
i=6
i=7
i=8
i=9
i=10
i=11
i=12
i=13
i=14
i=15
addr
0x8000
0x8008
0x8010
0x8018
0x8020
0x8028
0x8030
0x8038
0x8040
0x8048
0x8050
0x8058
0x8060
0x8068
0x8070
0x8078
v8
0x0000000000001003
0x0000000000002006
0x0000000000003009
0x000000000000400c
0x000000000000500f
0x0000000000006012
0x0000000000007015
0x0000000000008018
0x000000000000901b
0x000000000000a01e
0x000000000000b021
0x000000000000c024
0x000000000000d027
0x000000000000e02a
0x000000000000f02d
0x0000000000010030
active
1
1
0
1
1
1
1
0
1
1
1
1
0
1
1
1
memory write
...
...
-
...
...
...
...
-
...
...
...
...
-
...
...
...
步骤 1 / 22

显示向量内存指令编码

动画从 32 位向量内存指令编码开始,按官方位段显示 nf、mew、mop、vm、rs2/vs2 或 lumop/sumop、width、寄存器字段和 opcode。

快速理解与检索要点

VSE64.V 是 RVV 64 位单位步长向量存储:每个活动元素使用地址 x[rs1] + i * 8 字节写入内存,元素数据来自源向量寄存器组 vs3。vl 和 v0.t 掩码决定哪些 body 元素真正访问内存。

指令名固定内存元素宽度 EEW=64;单位步长地址按 EEW/8 字节递增,而不是按当前 SEW 文本或数组索引任意缩放。
单位步长形式从 x[rs1] 开始访问连续元素地址;stride 和 indexed/gather/scatter 访问属于 vlse/vsse、vluxei/vloxei、vsuxei/vsoxei 等其他指令族。
vm=0 时 v0.t 选择参与的 body 元素,vm=1 时所有 body 元素参与;被掩码关闭的元素不发起内存访问。
存储只对活动元素产生内存写入;被掩码关闭的元素不会写内存,也不应被动画误表示为写入 0。

向量执行上下文

阅读 VSE64.V 时,不要只看助记符。官方 V 扩展语义还依赖当前 vl、vtype 和掩码状态。后缀和操作数形式决定源操作数来自向量、标量还是立即数。

先看 vl

当前 vl 决定 body 元素数量。典型代码会先执行 vsetvli、vsetivli 或 vsetvl,再执行本页指令。

再看 vtype

当前 vtype 提供 SEW、LMUL、tail policy 和 mask policy;这些规则影响元素宽度、寄存器组大小以及非活动/尾部目标元素。

最后看 vm/v0

带 vm 的普通向量指令在 vm=0 时用 v0 作为执行掩码,vm=1 表示未掩码。VMERGE 等少数形式会把 v0 当作数据选择输入。

官方来源:RISC-V V Standard Extension for Vector Operations

常见使用场景

连续数组写入

结合 «vse64.v v8, (a0), v0.t» 等实际代码理解该场景。

向量化内存访问

结合 «vse64.v v8, (a0), v0.t» 等实际代码理解该场景。

使用前检查清单

语法检查
  • 确认当前指令格式为 V-type。
  • 确认操作数排列顺序与示例一致。
语义检查
  • 确认目标寄存器用途和调用约定兼容。
  • 确认该指令不是伪指令展开后的底层形式。

容易混淆 / 常见误区

指令名中的 64 是内存元素宽度 EEW;地址步长是 8 字节。
单位步长访问连续地址;不要把它当作 indexed gather/scatter。
被掩码关闭的元素不发起内存写入,也不会把内存位置写成 0。

常见问题

VSE64.V 会自动设置 vl 吗?

不会。vl/vtype 由此前的 vsetvli、vsetivli 或 vsetvl 设置;向量加载/存储按当前配置执行。

单位步长存储的地址如何计算?

第 i 个活动元素使用 x[rs1] + i * 8 字节;这是连续内存访问,不是任意 gather/scatter。

被 v0.t 关闭的元素会访问内存吗?

不会。vm=0 且对应 v0.t 位为 0 的 body 元素不会执行该元素的存储内存访问。