Token Saver v3
💡 Did you know? Every API call sends your workspace files (SOUL.md, USER.md, MEMORY.md, AGENTS.md, etc.) along with your message. These files count toward your context window, slowing responses and costing real money on every message.
Token Saver v3 is model-aware — it knows your model's context window and adapts recommendations accordingly. Using Gemini's 1M context? Presets scale up. On GPT-4o's 128K? Presets adjust down.
What's New in v3
| Feature |
v2 |
v3 |
| Compaction presets |
Fixed (80K/120K/160K) |
Dynamic (% of model's context) |
| Model detection |
Fragile, env-only |
Robust fallback chain |
| Context windows |
Not tracked |
Full registry (9 models) |
| Model info |
Hardcoded pricing |
JSON registry, easy updates |
| Already-optimized |
Re-compressed |
Smart bypass |
Commands
| Command |
What it does |
/optimize |
Full dashboard — files, models, context usage % |
/optimize tokens |
Compress workspace files (auto-backup) |
/optimize compaction |
Chat compaction control (model-aware) |
/optimize compaction balanced |
Apply balanced preset (60% of context) |
/optimize compaction 120 |
Custom threshold (compact at 120K) |
/optimize models |
Detailed model audit with registry |
/optimize revert |
Restore backups, disable persistent mode |
Features
📊 Model-Aware Dashboard
Shows current model, context window, and usage percentage:
🤖 Model: Claude Opus 4.5 (200K context)
Detected: openclaw.json
📊 Context Usage: [████████░░░░░░░░░░░░] 42% (84K/200K)
📁 Workspace File Compression
Scans all .md files, shows token count and potential savings. Smart bypass skips already-optimized files.
File-aware compression:
- SOUL.md — Light compression, keeps personality language
- AGENTS.md — Medium compression, dense instructions
- USER.md / MEMORY.md — Heavy compression, key:value format
- PROJECTS.md — No compression (user structure preserved)
💬 Dynamic Compaction Presets
Presets adapt to your model's context window:
| Preset |
% of Context |
Claude 200K |
GPT-4o 128K |
Gemini 1M |
| Aggressive |
40% |
80K |
51K |
400K |
| Balanced |
60% |
120K |
77K |
600K |
| Conservative |
80% |
160K |
102K |
800K |
| Off |
95% |
190K |
122K |
950K |
🤖 Model Registry
24+ models with context windows, pricing, and aliases:
- Claude: Opus 4.6 (1M), Opus 4.5, Sonnet 4.5, Sonnet 4, Haiku 4.5, Haiku 3.5 (200K)
- OpenAI: GPT-5.2, GPT-5.1, GPT-5-mini, GPT-5-nano (256K), GPT-4.1, GPT-4o (128K), o1, o3, o4-mini
- Gemini: 3 Pro (2M), 2.5 Pro, 2.0 Flash (1M)
- Others: DeepSeek V3 (64K), Kimi K2.5 (128K), Llama 3.3 70B, Mistral Large
🔍 Robust Model Detection
Detection priority:
- Runtime injection (
--model=...)
- Environment variables (
SKILL_MODEL, OPENCLAW_MODEL)
- Config file (
~/.openclaw/openclaw.json)
- File inference (TOOLS.md, MEMORY.md mentions)
- Fallback: Claude Sonnet 4 (safe default)
Unknown model handling:
- Strict version matching —
opus-6.5 won't fuzzy-match to opus-4.5
- Unknown models get safe defaults (200K context) + warning
- Easy to add new models to
scripts/models.json
📝 Persistent Mode
Adds writing guidance to AGENTS.md for continued token efficiency:
| File |
Writing Style |
| SOUL.md |
Evocative, personality-shaping |
| AGENTS.md |
Dense instructions, symbols OK |
| USER.md |
Key:value facts |
| MEMORY.md |
Ultra-dense data |
Safety
- Auto-backup — All modified files get
.backup extension
- Integrity > Size — Never sacrifices meaning for smaller tokens
- Smart bypass — Skips already-optimized files
- Revert anytime —
/optimize revert restores everything
- No external calls — All analysis runs locally
Installation
clawhub install token-saver --registry "https://www.clawhub.ai"
Version History
- 3.0.0 — Model registry, dynamic presets, robust detection, smart bypass
- 2.0.1 — Chat compaction, file-aware compression, persistent mode
- 1.0.0 — Initial release
1---2name: token-saver3description: Reduce OpenClaw AI costs with model-aware optimization. Features dynamic compaction presets based on your model's context window, intelligent file compression, and robust model detection with fallback. Supports Claude, GPT-4, Gemini, DeepSeek, and more.4---5
6# Token Saver v3
7
8> **💡 Did you know?** Every API call sends your workspace files (SOUL.md, USER.md, MEMORY.md, AGENTS.md, etc.) along with your message. These files count toward your context window, slowing responses and costing real money on every message.
9
10Token Saver v3 is **model-aware** — it knows your model's context window and adapts recommendations accordingly. Using Gemini's 1M context? Presets scale up. On GPT-4o's 128K? Presets adjust down.
11
12## What's New in v3
13
14| Feature | v2 | v3 |
15|---------|----|----|
16| Compaction presets | Fixed (80K/120K/160K) | Dynamic (% of model's context) |
17| Model detection | Fragile, env-only | Robust fallback chain |
18| Context windows | Not tracked | Full registry (9 models) |
19| Model info | Hardcoded pricing | JSON registry, easy updates |
20| Already-optimized | Re-compressed | Smart bypass |
21
22## Commands
23
24| Command | What it does |
25|---|---|
26| `/optimize` | Full dashboard — files, models, context usage % |
27| `/optimize tokens` | Compress workspace files (auto-backup) |
28| `/optimize compaction` | Chat compaction control (model-aware) |
29| `/optimize compaction balanced` | Apply balanced preset (60% of context) |
30| `/optimize compaction 120` | Custom threshold (compact at 120K) |
31| `/optimize models` | Detailed model audit with registry |
32| `/optimize revert` | Restore backups, disable persistent mode |
33
34## Features
35
36### 📊 Model-Aware Dashboard
37Shows current model, context window, and usage percentage:
38```
39🤖 Model: Claude Opus 4.5 (200K context)
40 Detected: openclaw.json
41
42📊 Context Usage: [████████░░░░░░░░░░░░] 42% (84K/200K)
43```
44
45### 📁 Workspace File Compression
46Scans all `.md` files, shows token count and potential savings. Smart bypass skips already-optimized files.
47
48**File-aware compression:**
49- **SOUL.md** — Light compression, keeps personality language
50- **AGENTS.md** — Medium compression, dense instructions
51- **USER.md / MEMORY.md** — Heavy compression, key:value format
52- **PROJECTS.md** — No compression (user structure preserved)
53
54### 💬 Dynamic Compaction Presets
55Presets adapt to your model's context window:
56
57| Preset | % of Context | Claude 200K | GPT-4o 128K | Gemini 1M |
58|--------|--------------|-------------|-------------|-----------|
59| Aggressive | 40% | 80K | 51K | 400K |
60| Balanced | 60% | 120K | 77K | 600K |
61| Conservative | 80% | 160K | 102K | 800K |
62| Off | 95% | 190K | 122K | 950K |
63
64### 🤖 Model Registry
6524+ models with context windows, pricing, and aliases:
66- **Claude:** Opus 4.6 (1M), Opus 4.5, Sonnet 4.5, Sonnet 4, Haiku 4.5, Haiku 3.5 (200K)
67- **OpenAI:** GPT-5.2, GPT-5.1, GPT-5-mini, GPT-5-nano (256K), GPT-4.1, GPT-4o (128K), o1, o3, o4-mini
68- **Gemini:** 3 Pro (2M), 2.5 Pro, 2.0 Flash (1M)
69- **Others:** DeepSeek V3 (64K), Kimi K2.5 (128K), Llama 3.3 70B, Mistral Large
70
71### 🔍 Robust Model Detection
72Detection priority:
731. Runtime injection (`--model=...`)
742. Environment variables (`SKILL_MODEL`, `OPENCLAW_MODEL`)
753. Config file (`~/.openclaw/openclaw.json`)
764. File inference (TOOLS.md, MEMORY.md mentions)
775. Fallback: Claude Sonnet 4 (safe default)
78
79**Unknown model handling:**
80- Strict version matching — `opus-6.5` won't fuzzy-match to `opus-4.5`
81- Unknown models get safe defaults (200K context) + warning
82- Easy to add new models to `scripts/models.json`
83
84### 📝 Persistent Mode
85Adds writing guidance to AGENTS.md for continued token efficiency:
86
87| File | Writing Style |
88|------|---------------|
89| SOUL.md | Evocative, personality-shaping |
90| AGENTS.md | Dense instructions, symbols OK |
91| USER.md | Key:value facts |
92| MEMORY.md | Ultra-dense data |
93
94## Safety
95
96- **Auto-backup** — All modified files get `.backup` extension
97- **Integrity > Size** — Never sacrifices meaning for smaller tokens
98- **Smart bypass** — Skips already-optimized files
99- **Revert anytime** — `/optimize revert` restores everything
100- **No external calls** — All analysis runs locally
101
102## Installation
103
104```
105clawhub install token-saver --registry "https://www.clawhub.ai"
106```
107
108## Version History
109- **3.0.0** — Model registry, dynamic presets, robust detection, smart bypass
110- **2.0.1** — Chat compaction, file-aware compression, persistent mode
111- **1.0.0** — Initial release