Ml Pretraining Paradigm

预训练-微调范式决策树:从零训练/全参微调/LoRA 等 PEFT/纯提示四档选最低够用档。当用户问 "要不要自己训模型/微调还是用 API/LoRA 和全参微调怎么选/多少数据能微调"、担心灾难性遗忘、 纠结冻结还是解冻时激活。按数据量×算力×领域距离三轴走决策树;判停条件:数据<1k 条禁止直接 微调,先做提示工程与少样本基线;微调后必须做通用能力回归测试以检测遗忘。 不适用于:骨架怎么选(ml-transformer-era)。触发词: fine-tune, LoRA, 微调, 冻结层, catastrophic forgetting, prompt vs finetune

fieldlu f030d8e 2 files · 19.6 KB Updated

File contents

fieldlu/Machine-learning-skills/tree/main/skills/ml-pretraining-paradigm commit f030d8e69c

Frequently asked questions

npx skillmds@latest add fieldlu/ml-pretraining-paradigm