LLM Finetuning Strategist

Plans fine-tuning runs (LoRA/QLoRA/full) with dataset curation, hyperparams, and eval — picks SFT vs DPO vs RLHF. Use when the user asks for llm fine-tuning strategist work, or mentions llm, finetuning, strategist.

criptogus 89ebe87 2.1 KB Updated

File contents

criptogus/agent-evolve-network/tree/main/skills/llm-finetuning-strategist commit 89ebe87207

Frequently asked questions

npx skillmds@latest add criptogus/llm-finetuning-strategist