首页/指令库/VWMACCU-VV
VWMACCU.VV

RISC-V VWMACCU.VV 指令详解

指令手册R-type

VWMACCU.VV 读取旧 2*SEW 宽 vd 累加器,加上活动元素的 2*SEW 拓宽乘积。

指令语法

vwmaccu.vv vd, vs1, vs2, vm
操作数说明
vd:目标向量寄存器组。
vs2/vs1 或标量源:按指令后缀 .vv/.vx/.vi/.vf 决定来源。
vm:若语法包含 vm,vm=0 使用 v0 作为执行掩码,vm=1 为未掩码。
V向量运算整数算术

指令行为说明

VWMACCU.VV 是 RISC-V V 扩展的无符号拓宽向量乘加指令。每个活动元素读取旧 2*SEW 宽 vd[i],按无符号 vs1[i] 与无符号 vs2[i]解释 SEW 宽乘法输入,生成 2*SEW 乘积并累加写回 vd[i]。vm=0 时只有 v0.t 为 1 的 body 元素更新;mask-off 和 tail 元素按当前 vtype 策略处理。

VWMACCU.VV 指令解析与执行动画

从 OP-V 编码字段开始,展示 VWMACCU 如何读取旧 2*SEW 宽 vd 累加器,按无符号×无符号生成乘积,并写回累加结果。

输入的指令
vwmaccu.vv
OP-V encodingvwmaccu.vv
funct6
111100
vm
0
vs2
01000
vs1
01100
funct3
010
vd
00100
opcode
1010111
lane
0
1
2
3
4
5
6
7
old v4
0xffffffdf
0x00000131
0x00000162
0x00000193
0xffffffcb
0x000001f5
0x00000226
0x00000257
v8
0xfffe
0x003a
0x004f
0xfffb
0x0079
0x008e
0xfff8
0x00b8
acc+w*
acc+w*
acc+w*
acc+w*
acc+w*
acc+w*
acc+w*
acc+w*
v12
0x0009
0xfffb
0x001f
0xfff9
0x0035
0xfff7
0x004b
0xfff5
v0.t
1
0
1
1
1
0
1
1
v4
...
-
...
...
...
-
...
...
当前步骤

显示 OP-V 32 位编码字段

vwmaccu.vv 使用 OP-V 编码。动画把固定字段、寄存器字段、vm 和 vs1 字段放在同一条编码带中。

动画只展示官方 V 扩展定义的 ISA 可见关系:OP-V 字段解析、活动元素读取、2*SEW 拓宽整数无符号拓宽乘加、旧 vd 累加器和 vd 写回;不模拟流水线、缓存或执行时延。

快速理解与检索要点

VWMACCU.VV 是破坏性拓宽乘加:vd 先作为 2*SEW 宽累加器被读取,再加上按无符号 vs1[i] 与无符号 vs2[i]得到的 2*SEW 乘积,最后写回 vd。

VWMACCU.VV 使用 OP-V 乘法/乘加类编码;vv 形式由 funct3=010 选择。
每个活动元素执行 vd[i] = vd[i] + zero_extend(vs1[i]) * zero_extend(vs2[i]),结果宽度保持 2*SEW 并写回同一个 vd 累加器。
对 .vv 形式,两个乘法输入都来自 SEW 宽向量元素,旧 vd 是 2*SEW 宽累加器。
vd 是破坏性目标累加器,旧 2*SEW 宽 vd 值会被读取并覆盖;目标 EMUL 是源 EMUL 的两倍,寄存器组选择仍需满足 V 扩展对拓宽目标和重叠的合法性约束。
只处理当前 vl 范围内的 body 元素;vm=0 使用 v0.t 掩码,mask-off 和 tail 元素按当前 vtype 策略处理。

向量执行上下文

阅读 VWMACCU.VV 时,不要只看助记符。官方 V 扩展语义还依赖当前 vl、vtype 和掩码状态。.vv:两个向量源逐元素参与运算。

先看 vl

当前 vl 决定 body 元素数量。典型代码会先执行 vsetvli、vsetivli 或 vsetvl,再执行本页指令。

再看 vtype

当前 vtype 提供 SEW、LMUL、tail policy 和 mask policy;这些规则影响元素宽度、寄存器组大小以及非活动/尾部目标元素。

最后看 vm/v0

带 vm 的普通向量指令在 vm=0 时用 v0 作为执行掩码,vm=1 表示未掩码。VMERGE 等少数形式会把 v0 当作数据选择输入。

官方来源:RISC-V V Standard Extension for Vector Operations

常见使用场景

向量化循环

结合 «vwmaccu.vv v8, v4, v12, v0.t # unsigned widening multiply-accumulate» 等实际代码理解该场景。

整数乘法

结合 «vwmaccu.vv v8, v4, v12, v0.t # unsigned widening multiply-accumulate» 等实际代码理解该场景。

多精度累加

结合 «vwmaccu.vv v8, v4, v12, v0.t # unsigned widening multiply-accumulate» 等实际代码理解该场景。

使用前检查清单

语法检查
  • 确认当前指令格式为 R-type。
  • 确认操作数排列顺序与示例一致。
语义检查
  • 确认目标寄存器用途和调用约定兼容。
  • 确认该指令不是伪指令展开后的底层形式。

容易混淆 / 常见误区

vd 是 2*SEW 宽累加器,本指令会读旧 vd 并写回累加结果;不要把它当作只写乘积的 VWMUL*。
官方 .vv 语法为 vd, vs1, vs2, vm;乘法源顺序不同于普通 VWMUL* 页面。
符号解释是无符号 vs1[i] 与无符号 vs2[i];不要和 VWMACC/VWMACCU/VWMACCSU/VWMACCUS 其他形式混淆。
vm=0 时 mask-off 目标元素由当前 mask policy 决定,不能假定固定清零或保持。

常见问题

VWMACCU.VV 和 VWMUL* 有什么区别?

VWMACCU.VV 读取旧 vd 作为 2*SEW 宽累加器并写回累加结果。VWMUL* 只写完整 2*SEW 乘积,不读取旧 vd 累加。

VWMACCU.VV 会固定处理整个向量寄存器吗?

不会。V 扩展指令按 vl、vtype、vstart 和可选 v0.t 掩码确定活动元素;未活动元素由当前 tail/mask policy 处理。