LLM Finetuning

Use when fine-tuning a large language model. Covers choosing full vs LoRA/QLoRA, dataset formatting, the transformers/PEFT/TRL stack, key hyperparameters, and evaluating fine-tunes without overfitting.

param087 Updated

File contents

param087/agent-ml-skills/tree/main/skills/llm-finetuning commit 6b8de31545

Frequently asked questions

npx skillmds@latest add param087/llm-finetuning