OPERATOR RULE

TopK

量化模式下,X 与每个已使用或作为 graph output 的 Values 输出共享完整量化参数。

量化或非量化模式
规则定位量化或非量化模式
量化判定按模式判定
数据类型量化模式:激活 S8 / U8 / S16 / U16;另有原生模式
示例状态5/5 PASS

数据类型与量化边界

数据类型概述
量化模式:激活 S8 / U8 / S16 / U16;另有原生模式
量化要求
按模式判定

规则原文

规则定位:量化或非量化模式

本页是 ax quant spec 的逐算子展开。本页与统一规范冲突时,以统一规范为准。

规则

  • 量化模式下,X 与每个已使用或作为 graph output 的 Values 输出共享完整量化参数。
  • Values 完全未使用且不是 graph output 时不要求 Q/DQ。
  • Indices 使用原生整数类型,不量化。
  • 激活量化类型从 S8 对称或非对称、U8 非对称、S16 对称、U16 非对称中选择,粒度为 per-tensor。
  • 非量化模式不拥有 Q/DQ。

本文档未增加限制的属性、shape 和输入形式,遵循模型声明 opset 下的 ONNX 语义。

MODEL EVIDENCE

可验证的 ONNX 案例

每张卡片直接嵌入对应的 Netron 模型图,进入页面后自动加载。

代表性结构

VERIFIED

覆盖该页面的主规则路径。

errors 0warnings 0nodes 5Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开

U8 激活

VERIFIED

输入与输出共享 U8 非对称 per-tensor 量化参数。

errors 0warnings 0nodes 5Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开

S16 激活

VERIFIED

输入与输出共享 S16 对称 per-tensor 量化参数。

errors 0warnings 0nodes 5Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开

U16 激活

VERIFIED

输入与输出共享 U16 非对称 per-tensor 量化参数。

errors 0warnings 0nodes 5Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开

非量化模式

VERIFIED

量化分支拥有 Q/DQ;非量化分支不拥有 Q/DQ。

errors 0warnings 0nodes 6Q/DQ 2 / 2patterns none
Netron正在加载模型…
新窗口打开