Pretrain Zero Active Pretraining

Bilevel min-max optimization where mask generator selects informative spans from pretraining data and mask predictor recovers them via chain-of-thought, enabling effective RL pretraining on noisy corpora without supervised fine-tuning.

adu2021 17edd3b 3.4 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/pretrain-zero-active-pretraining commit 17edd3b457

Frequently asked questions

npx skillmds@latest add adu2021/pretrain-zero-active-pretraining