Web Agent Training Optimization

Optimize open-source LLM web agent training through systematic analysis of supervised fine-tuning vs. reinforcement learning trade-offs. Achieve 45% lower compute cost by branching into RL at strategic SFT checkpoints.

adu2021 f19133a 11.0 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/web-agent-training-optimization commit f19133ae0e

Frequently asked questions

npx skillmds@latest add adu2021/web-agent-training-optimization