Aimet Quantization

Quantize an ONNX model for Qualcomm HTP with AIMET - QuantizationSimModel (quantsim) calibration, AdaRound adaptive weight rounding, cross-layer equalization, bias correction and automatic mixed precision - exporting a .encodings file consumed by qnn-onnx-converter or qairt-converter via --quantization_overrides. Use for post-training quantization (PTQ), W8A16/W8A8 accuracy recovery, per-layer quantization sensitivity analysis, or when a converted model runs but its accuracy dropped. Runs on the AIMET host, not the board.

dev-ansh-r Updated

File contents

dev-ansh-r/qualcomm-claude-skills/tree/main/skills/aimet-quantization commit 80a726b5df

Frequently asked questions

npx skillmds@latest add dev-ansh-r/aimet-quantization