Qnn Model Export

Convert an ONNX model to a QNN model library for Qualcomm HTP using the classic flow - static-shape preparation, calibration input_list generation, qnn-onnx-converter with W8A16 quantization, then qnn-model-lib-generator to produce an aarch64 .so, validated with qnn-net-run. Accepts AIMET .encodings via --quantization_overrides alongside --input_list. Use for Qualcomm/Hexagon HTP model conversion, whether a model will run on the NPU, FP16 or float_fallback errors, or any qnn-onnx-converter, model-lib-generator, input_list, bias_bw or W8A16 question. The DLC alternative is qnn-context-binary.

dev-ansh-r Updated

File contents

dev-ansh-r/qualcomm-claude-skills/tree/main/skills/qnn-model-export commit 94eee4a41b

Frequently asked questions

npx skillmds@latest add dev-ansh-r/qnn-model-export