Llamacpp Docs

Use when working with llama.cpp: building from source, installation, GGUF model loading, quantization, speculative decoding, function calling, multimodal models (LLaVA, Gemma3, MiniCPM), GPU backends (CUDA, Metal, Vulkan, SYCL, OpenCL, CANN), Android deployment, Docker setup, performance tuning, or adding new model architectures to llama.cpp.

wenerme a401b48 51 files · 458.1 KB Updated

File contents

wenerme/ai/tree/main/skills/llamacpp-docs commit a401b4810e

Frequently asked questions

npx skillmds@latest add wenerme/llamacpp-docs