LLM Fine Tuning Pipeline

Build end-to-end LLM fine-tuning pipelines — dataset preparation with quality filtering, SFT training with Hugging Face Trainer and TRL, LoRA/QLoRA PEFT configuration, DPO preference optimization, evaluation with LM-Eval, and vLLM serving of fine-tuned adapters.

UltronCore Updated

File contents

UltronCore/claude-skill-vault/tree/main/skills/ai-ml/llm-fine-tuning-pipeline commit 95cf6cdfc0

Frequently asked questions

npx skillmds@latest add ultroncore/llm-fine-tuning-pipeline