Evolution Strategies LLM Finetuning

Scale Evolution Strategies to billion-parameter LLMs without backpropagation for superior robustness and stability across diverse models, reward horizons, and evaluation tasks. Outperforms RL methods while eliminating gradient computation overhead.

adu2021 035f42c 15.9 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/evolution-strategies-llm-finetuning commit 035f42c491

Frequently asked questions

npx skillmds@latest add adu2021/evolution-strategies-llm-finetuning