Model Routing System
You have access to intelligent model routing. Before executing any task, analyze complexity and route to the appropriate model tier.
Current model IDs (June 2026 — verify at platform.claude.com):
Haiku → claude-haiku-4-5 · Sonnet → claude-sonnet-4-6 · Opus → claude-opus-4-8 (default).
For the hardest long-horizon reasoning, escalate above Opus to claude-fable-5 (most capable;
priced above Opus tier — reserve for genuinely demanding work). The tiers below are model-agnostic.
Routing Decision Matrix
TASK COMPLEXITY ANALYSIS
────────────────────────────────────────────────────────────────
HAIKU (Fast, Cheap) - Use for:
├── Simple file operations (read, list, navigate)
├── Scaffolding and boilerplate generation
├── Deterministic transformations (format, lint, compile)
├── Status checks and health monitoring
├── SEO metadata generation
├── Deployment commands (after code is written)
├── Documentation formatting
├── Simple search and replace
│
│ Token cost: ~$0.25/1M input, $1.25/1M output
│ Latency: Fastest
│ Use when: Task has clear, unambiguous steps
SONNET (Balanced) - Use for:
├── Feature implementation (standard complexity)
├── Bug fixes requiring analysis
├── Content writing (articles, social posts)
├── Code review and quality checks
├── Test generation
├── Refactoring with clear patterns
├── API integration work
├── Database schema design
│
│ Token cost: ~$3/1M input, $15/1M output
│ Latency: Medium
│ Use when: Task requires reasoning but not deep strategy
OPUS (Strategic, Complex) - Use for:
├── Architecture decisions (system design)
├── Multi-agent coordination (council, swarm)
├── Strategic planning (business, product)
├── Complex debugging (multi-file, subtle bugs)
├── Security audits and vulnerability analysis
├── Enterprise AI system design
├── Book writing (narrative, character development)
├── Research synthesis (multiple sources)
├── Ambiguous requirements interpretation
│
│ Token cost: ~$15/1M input, $75/1M output
│ Latency: Slowest but most capable
│ Use when: Task requires deep reasoning, creativity, or strategy
Automatic Routing Rules
When processing a request, apply these rules:
Route to HAIKU when:
- User says: "deploy", "format", "lint", "check status", "list", "scaffold"
- File patterns:
*.config.*, package.json, tsconfig.json
- Commands:
/mcp-status, /inventory-status, /nextjs-deploy (execution phase)
Route to SONNET when:
- User says: "write", "implement", "fix", "create", "build", "test"
- File patterns:
*.ts, *.tsx, *.py, *.md (content files)
- Commands:
/article-creator, /create-music, /spec, /generate-social
Route to OPUS when:
- User says: "design", "architect", "strategy", "council", "analyze", "research"
- Keywords: "enterprise", "system", "multi-agent", "complex", "strategic"
- Commands:
/starlight-architect, /council, /author-team, /research
Cost Optimization
BEFORE (No routing):
All tasks → Opus → $75/1M output tokens
AFTER (With routing):
Simple tasks (40%) → Haiku → $1.25/1M = $0.50
Medium tasks (45%) → Sonnet → $15/1M = $6.75
Complex tasks (15%) → Opus → $75/1M = $11.25
──────────────────────────────────────────────
TOTAL: $18.50 vs $75 = 75% cost reduction
Implementation in Task Tool
When using the Task tool, specify model based on routing:
// Simple task - use haiku
Task({
subagent_type: "Explore",
model: "haiku",
prompt: "List all files in src/"
})
// Medium task - use sonnet (default)
Task({
subagent_type: "code-reviewer",
model: "sonnet",
prompt: "Review this PR for issues"
})
// Complex task - use opus
Task({
subagent_type: "Plan",
model: "opus",
prompt: "Design the architecture for a multi-tenant SaaS platform"
})
Command-Level Routing
| Command |
Default Model |
Rationale |
/acos |
sonnet |
Router needs reasoning |
/article-creator |
sonnet |
Content creation |
/create-music |
sonnet |
Creative work |
/infogenius |
sonnet |
Research + creation |
/starlight-architect |
opus |
Strategic design |
/council |
opus |
Multi-perspective |
/research |
sonnet |
Information synthesis |
/spec |
sonnet |
Feature planning |
/nextjs-deploy |
haiku |
Execution |
/mcp-status |
haiku |
Status check |
/inventory-status |
haiku |
Status check |
/publish |
haiku |
Execution |
/polish-content |
sonnet |
Editing |
/review-content |
sonnet |
Quality check |
Escalation Pattern
If a haiku-routed task fails or produces poor results:
- Automatically escalate to sonnet
- If still failing, escalate to opus
- Log escalation for learning
haiku (attempt) → fail → sonnet (retry) → fail → opus (final)
Model Routing v1.0 - Implementing claude-flow's intelligent routing pattern
1---2name: model-routing3description: Intelligent model selection — routes tasks to Haiku (fast/cheap), Sonnet (balanced), or Opus (complex/strategic) by analyzing task complexity. Use when deciding which model to run, optimizing cost vs quality, or building a tiered routing layer.4---56# Model Routing System78You have access to intelligent model routing. Before executing any task, analyze complexity and route to the appropriate model tier.910> **Current model IDs (June 2026 — verify at [platform.claude.com](https://platform.claude.com/docs/en/about-claude/models/overview)):**11> Haiku → `claude-haiku-4-5` · Sonnet → `claude-sonnet-4-6` · Opus → `claude-opus-4-8` (default).12> For the hardest long-horizon reasoning, escalate above Opus to **`claude-fable-5`** (most capable;13> priced above Opus tier — reserve for genuinely demanding work). The tiers below are model-agnostic.1415## Routing Decision Matrix1617```18TASK COMPLEXITY ANALYSIS19────────────────────────────────────────────────────────────────2021HAIKU (Fast, Cheap) - Use for:22├── Simple file operations (read, list, navigate)23├── Scaffolding and boilerplate generation24├── Deterministic transformations (format, lint, compile)25├── Status checks and health monitoring26├── SEO metadata generation27├── Deployment commands (after code is written)28├── Documentation formatting29├── Simple search and replace30│31│ Token cost: ~$0.25/1M input, $1.25/1M output32│ Latency: Fastest33│ Use when: Task has clear, unambiguous steps3435SONNET (Balanced) - Use for:36├── Feature implementation (standard complexity)37├── Bug fixes requiring analysis38├── Content writing (articles, social posts)39├── Code review and quality checks40├── Test generation41├── Refactoring with clear patterns42├── API integration work43├── Database schema design44│45│ Token cost: ~$3/1M input, $15/1M output46│ Latency: Medium47│ Use when: Task requires reasoning but not deep strategy4849OPUS (Strategic, Complex) - Use for:50├── Architecture decisions (system design)51├── Multi-agent coordination (council, swarm)52├── Strategic planning (business, product)53├── Complex debugging (multi-file, subtle bugs)54├── Security audits and vulnerability analysis55├── Enterprise AI system design56├── Book writing (narrative, character development)57├── Research synthesis (multiple sources)58├── Ambiguous requirements interpretation59│60│ Token cost: ~$15/1M input, $75/1M output61│ Latency: Slowest but most capable62│ Use when: Task requires deep reasoning, creativity, or strategy63```6465## Automatic Routing Rules6667When processing a request, apply these rules:6869### Route to HAIKU when:70- User says: "deploy", "format", "lint", "check status", "list", "scaffold"71- File patterns: `*.config.*`, `package.json`, `tsconfig.json`72- Commands: `/mcp-status`, `/inventory-status`, `/nextjs-deploy` (execution phase)7374### Route to SONNET when:75- User says: "write", "implement", "fix", "create", "build", "test"76- File patterns: `*.ts`, `*.tsx`, `*.py`, `*.md` (content files)77- Commands: `/article-creator`, `/create-music`, `/spec`, `/generate-social`7879### Route to OPUS when:80- User says: "design", "architect", "strategy", "council", "analyze", "research"81- Keywords: "enterprise", "system", "multi-agent", "complex", "strategic"82- Commands: `/starlight-architect`, `/council`, `/author-team`, `/research`8384## Cost Optimization8586```87BEFORE (No routing):88 All tasks → Opus → $75/1M output tokens8990AFTER (With routing):91 Simple tasks (40%) → Haiku → $1.25/1M = $0.5092 Medium tasks (45%) → Sonnet → $15/1M = $6.7593 Complex tasks (15%) → Opus → $75/1M = $11.2594 ──────────────────────────────────────────────95 TOTAL: $18.50 vs $75 = 75% cost reduction96```9798## Implementation in Task Tool99100When using the Task tool, specify model based on routing:101102```javascript103// Simple task - use haiku104Task({105 subagent_type: "Explore",106 model: "haiku",107 prompt: "List all files in src/"108})109110// Medium task - use sonnet (default)111Task({112 subagent_type: "code-reviewer",113 model: "sonnet",114 prompt: "Review this PR for issues"115})116117// Complex task - use opus118Task({119 subagent_type: "Plan",120 model: "opus",121 prompt: "Design the architecture for a multi-tenant SaaS platform"122})123```124125## Command-Level Routing126127| Command | Default Model | Rationale |128|---------|---------------|-----------|129| `/acos` | sonnet | Router needs reasoning |130| `/article-creator` | sonnet | Content creation |131| `/create-music` | sonnet | Creative work |132| `/infogenius` | sonnet | Research + creation |133| `/starlight-architect` | **opus** | Strategic design |134| `/council` | **opus** | Multi-perspective |135| `/research` | sonnet | Information synthesis |136| `/spec` | sonnet | Feature planning |137| `/nextjs-deploy` | haiku | Execution |138| `/mcp-status` | haiku | Status check |139| `/inventory-status` | haiku | Status check |140| `/publish` | haiku | Execution |141| `/polish-content` | sonnet | Editing |142| `/review-content` | sonnet | Quality check |143144## Escalation Pattern145146If a haiku-routed task fails or produces poor results:1471. Automatically escalate to sonnet1482. If still failing, escalate to opus1493. Log escalation for learning150151```152haiku (attempt) → fail → sonnet (retry) → fail → opus (final)153```154155---156157*Model Routing v1.0 - Implementing claude-flow's intelligent routing pattern*