Add Inference Backend

Add a new hardware inference backend to AutoRound for deploying quantized models (e.g., CUDA/Marlin, Triton, CPU, HPU, ARK). Use when implementing QuantLinear kernels, registering backend capabilities, or enabling quantized model inference on a new hardware platform.

intel 426de37 9.0 KB Updated

File contents

intel/auto-round/tree/main/.claude/skills/add-inference-backend commit 426de37ef5

Frequently asked questions

npx skillmds@latest add intel/add-inference-backend