Llama Cpp

Run GGUF models locally with llama.cpp, including finding the right file on the Hugging Face Hub, installing, quantizing, serving, and using Python bindings.

infinition Updated 2 repo stars

File contents

infinition/LaRuche/tree/main/laruche/skills/llama-cpp commit 33bc6f0c8f

Frequently asked questions

npx skillmds@latest add infinition/llama-cpp