OPERATOR RULE

Clip

min 和 max 只允许省略或使用直接引用的 FP32 initializer;动态 min 或 max 不符合 ax quant spec。

quant-only · 分支局部融合尾
规则定位quant-only · 分支局部融合尾
量化判定数据输入和输出必须量化
数据类型激活 S8 / U8 / S16 / U16,per-tensor
示例状态4/4 PASS

数据类型与量化边界

数据类型概述
激活 S8 / U8 / S16 / U16,per-tensor
量化要求
数据输入和输出必须量化

规则原文

规则定位:quant-only / 分支局部融合尾

本页是 ax quant spec 的逐算子展开。本页与统一规范冲突时,以统一规范为准。

规则

  • min 和 max 只允许省略或使用直接引用的 FP32 initializer;动态 min 或 max 不符合 ax quant spec。
  • 静态边界值不限定为 ReLU6 等固定范围。
  • 对称量化时,Clip 前后都必须具有完整 Q/DQ,不形成融合尾。
  • 非对称量化允许独立形式或分支局部融合尾;融合主算子与 Clip 之间不插入 Q/DQ。
  • 输出 zero_point 遵循输出量化方式:对称时为 0,非对称时位于存储类型范围内。
  • 激活量化类型从 S8 对称或非对称、U8 非对称、S16 对称、U16 非对称中选择,粒度为 per-tensor。

本文档未增加限制的属性、shape 和输入形式,遵循模型声明 opset 下的 ONNX 语义。

与 Pattern 的关系

  • 融合只拥有选中的 Clip 分支;主算子的其他消费者分别遵循各自规则。

MODEL EVIDENCE

可验证的 ONNX 案例

每张卡片直接嵌入对应的 Netron 模型图,进入页面后自动加载。

代表性结构

VERIFIED

覆盖该页面的主规则路径。

errors 0warnings 0nodes 5Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开

U8 激活

VERIFIED

输入使用 U8 非对称 per-tensor;输出类型相同且 zero_point 为 0。

errors 0warnings 0nodes 5Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开

S16 激活

VERIFIED

输入使用 S16 对称 per-tensor;输出类型相同且 zero_point 为 0。

errors 0warnings 0nodes 5Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开

U16 激活

VERIFIED

输入使用 U16 非对称 per-tensor;输出类型相同且 zero_point 为 0。

errors 0warnings 0nodes 5Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开