无 bias
VERIFIED权重使用整数量化 initializer,经 DQ 进入主算子。
errors 0warnings 0nodes 6Q/DQ 2 / 3patterns none
Netron正在加载模型…
新窗口打开OPERATOR RULE
输入激活、权重和输出激活都必须量化。
规则定位:quant-only
本页是 ax quant spec 的逐算子展开。本页与统一规范冲突时,以统一规范为准。
scale 和 zero_point 相互独立。axis = 0。bias_scale = input_scale * weight_scale;该数值检查为 warn,受 check_value 控制,使用绝对阈值 1e-7 和相对阈值 1e-5 判定。本文档未增加限制的属性、shape 和输入形式,遵循模型声明 opset 下的 ONNX 语义。
MODEL EVIDENCE
每张卡片直接嵌入对应的 Netron 模型图,进入页面后自动加载。
权重使用整数量化 initializer,经 DQ 进入主算子。
激活使用 U4 非对称 per-tensor,输入通道数为偶数;权重 S8 per-channel,无 bias。
激活使用 S16 对称 per-tensor;权重 S8 per-channel,无 bias。
激活使用 U16 非对称 per-tensor;权重 S8 per-channel,无 bias。
直接引用 FP32 initializer 作为 bias。
使用 INT32 initializer 经 DQ 表达逐通道 bias。
使用 INT4 per-channel 权重 DQ,输出通道数为偶数。
展示不在融合 Pattern 内插入 Q/DQ 的结构。