Skill Tuning
Autonomous diagnosis and optimization for skill execution issues.
Architecture
┌─────────────────────────────────────────────────────┐
│ Phase 0: Read Specs (mandatory) │
│ → problem-taxonomy.md, tuning-strategies.md │
└─────────────────────────────────────────────────────┘
↓
┌─────────────────────────────────────────────────────┐
│ Orchestrator (state-driven) │
│ Read state → Select action → Execute → Update → ✓ │
└─────────────────────────────────────────────────────┘
↓ ↓
┌──────────────────────┐ ┌──────────────────┐
│ Diagnosis Phase │ │ Gemini CLI │
│ • Context │ │ Deep analysis │
│ • Memory │ │ (on-demand) │
│ • DataFlow │ │ │
│ • Agent │ │ Complex issues │
│ • Docs │ │ Architecture │
│ • Token Usage │ │ Performance │
└──────────────────────┘ └──────────────────┘
↓
┌───────────────────┐
│ Fix & Verify │
│ Apply → Re-test │
└───────────────────┘
Core Issues Detected
| Priority |
Problem |
Root Cause |
Fix Strategy |
| P0 |
Authoring Violation |
Intermediate files, state bloat, file relay |
eliminate_intermediate, minimize_state |
| P1 |
Data Flow Disruption |
Scattered state, inconsistent formats |
state_centralization, schema_enforcement |
| P2 |
Agent Coordination |
Fragile chains, no error handling |
error_wrapping, result_validation |
| P3 |
Context Explosion |
Unbounded history, full content passing |
sliding_window, path_reference |
| P4 |
Long-tail Forgetting |
Early constraint loss |
constraint_injection, checkpoint_restore |
| P5 |
Token Consumption |
Verbose prompts, state bloat |
prompt_compression, lazy_loading |
Problem Categories (Detailed Specs)
See specs/problem-taxonomy.md for:
- Detection patterns (regex/checks)
- Severity calculations
- Impact assessments
Tuning Strategies (Detailed Specs)
See specs/tuning-strategies.md for:
- 10+ strategies per category
- Implementation patterns
- Verification methods
Workflow
| Step |
Action |
Orchestrator Decision |
Output |
| 1 |
action-init |
status='pending' |
Backup, session created |
| 2 |
action-analyze-requirements |
After init |
Required dimensions + coverage |
| 3 |
Diagnosis (6 types) |
Focus areas |
state.diagnosis.{type} |
| 4 |
action-gemini-analysis |
Critical issues OR user request |
Deep findings |
| 5 |
action-generate-report |
All diagnosis complete |
state.final_report |
| 6 |
action-propose-fixes |
Issues found |
state.proposed_fixes[] |
| 7 |
action-apply-fix |
Pending fixes |
Applied + verified |
| 8 |
action-complete |
Quality gates pass |
session.status='completed' |
Action Reference
| Category |
Actions |
Purpose |
| Setup |
action-init |
Initialize backup, session state |
| Analysis |
action-analyze-requirements |
Decompose user request via Gemini CLI |
| Diagnosis |
action-diagnose-{context,memory,dataflow,agent,docs,token_consumption} |
Detect category-specific issues |
| Deep Analysis |
action-gemini-analysis |
Gemini CLI: complex/critical issues |
| Reporting |
action-generate-report |
Consolidate findings → final_report |
| Fixing |
action-propose-fixes, action-apply-fix |
Generate + apply fixes |
| Verify |
action-verify |
Re-run diagnosis, check gates |
| Exit |
action-complete, action-abort |
Finalize or rollback |
Full action details: phases/actions/
State Management
Single source of truth: .workflow/.scratchpad/skill-tuning-{ts}/state.json
{
"status": "pending|running|completed|failed",
"target_skill": { "name": "...", "path": "..." },
"diagnosis": {
"context": {...},
"memory": {...},
"dataflow": {...},
"agent": {...},
"docs": {...},
"token_consumption": {...}
},
"issues": [{"id":"...", "severity":"...", "category":"...", "strategy":"..."}],
"proposed_fixes": [...],
"applied_fixes": [...],
"quality_gate": "pass|fail",
"final_report": "..."
}
See phases/state-schema.md for complete schema.
Orchestrator Logic
See phases/orchestrator.md for:
- Decision logic (termination checks → action selection)
- State transitions
- Error recovery
Key Principles
- Problem-First: Diagnosis before any fix
- Data-Driven: Record traces, token counts, snapshots
- Iterative: Multiple rounds until quality gates pass
- Reversible: All changes with backup checkpoints
- Non-Invasive: Minimal changes, maximum clarity
Usage Examples
# Basic skill diagnosis
/skill-tuning "Fix memory leaks in my skill"
# Deep analysis with Gemini
/skill-tuning "Architecture issues in async workflow"
# Focus on specific areas
/skill-tuning "Optimize token consumption and fix agent coordination"
# Custom issue
/skill-tuning "My skill produces inconsistent outputs"
Output
After completion, review:
.workflow/.scratchpad/skill-tuning-{ts}/state.json - Full state with final_report
state.final_report - Markdown summary (in state.json)
state.applied_fixes - List of applied fixes with verification results
Reference Documents
| Document |
Purpose |
| specs/problem-taxonomy.md |
Classification + detection patterns |
| specs/tuning-strategies.md |
Fix implementation guide |
| specs/dimension-mapping.md |
Dimension ↔ Spec mapping |
| specs/quality-gates.md |
Quality verification criteria |
| phases/orchestrator.md |
Workflow orchestration |
| phases/state-schema.md |
State structure definition |
| phases/actions/ |
Individual action implementations |
Converted and distributed by TomeVault — claim your Tome and manage your conversions.
1---2name: skill-tuning3description: Universal skill diagnosis and optimization tool. Detect and fix skill execution issues including context explosion, long-tail forgetting, data flow disruption, and agent coordination failures. Supports Gemini CLI for deep analysis. Triggers on "skill tuning", "tune skill", "skill diagnosis", "optimize skill", "skill debug". Use when this capability is needed.4---56# Skill Tuning78Autonomous diagnosis and optimization for skill execution issues.910## Architecture1112```13┌─────────────────────────────────────────────────────┐14│ Phase 0: Read Specs (mandatory) │15│ → problem-taxonomy.md, tuning-strategies.md │16└─────────────────────────────────────────────────────┘17 ↓18┌─────────────────────────────────────────────────────┐19│ Orchestrator (state-driven) │20│ Read state → Select action → Execute → Update → ✓ │21└─────────────────────────────────────────────────────┘22 ↓ ↓23┌──────────────────────┐ ┌──────────────────┐24│ Diagnosis Phase │ │ Gemini CLI │25│ • Context │ │ Deep analysis │26│ • Memory │ │ (on-demand) │27│ • DataFlow │ │ │28│ • Agent │ │ Complex issues │29│ • Docs │ │ Architecture │30│ • Token Usage │ │ Performance │31└──────────────────────┘ └──────────────────┘32 ↓33 ┌───────────────────┐34 │ Fix & Verify │35 │ Apply → Re-test │36 └───────────────────┘37```3839## Core Issues Detected4041| Priority | Problem | Root Cause | Fix Strategy |42|----------|---------|-----------|--------------|43| **P0** | Authoring Violation | Intermediate files, state bloat, file relay | eliminate_intermediate, minimize_state |44| **P1** | Data Flow Disruption | Scattered state, inconsistent formats | state_centralization, schema_enforcement |45| **P2** | Agent Coordination | Fragile chains, no error handling | error_wrapping, result_validation |46| **P3** | Context Explosion | Unbounded history, full content passing | sliding_window, path_reference |47| **P4** | Long-tail Forgetting | Early constraint loss | constraint_injection, checkpoint_restore |48| **P5** | Token Consumption | Verbose prompts, state bloat | prompt_compression, lazy_loading |4950## Problem Categories (Detailed Specs)5152See [specs/problem-taxonomy.md](specs/problem-taxonomy.md) for:53- Detection patterns (regex/checks)54- Severity calculations55- Impact assessments5657## Tuning Strategies (Detailed Specs)5859See [specs/tuning-strategies.md](specs/tuning-strategies.md) for:60- 10+ strategies per category61- Implementation patterns62- Verification methods6364## Workflow6566| Step | Action | Orchestrator Decision | Output |67|------|--------|----------------------|--------|68| 1 | `action-init` | status='pending' | Backup, session created |69| 2 | `action-analyze-requirements` | After init | Required dimensions + coverage |70| 3 | Diagnosis (6 types) | Focus areas | state.diagnosis.{type} |71| 4 | `action-gemini-analysis` | Critical issues OR user request | Deep findings |72| 5 | `action-generate-report` | All diagnosis complete | state.final_report |73| 6 | `action-propose-fixes` | Issues found | state.proposed_fixes[] |74| 7 | `action-apply-fix` | Pending fixes | Applied + verified |75| 8 | `action-complete` | Quality gates pass | session.status='completed' |7677## Action Reference7879| Category | Actions | Purpose |80|----------|---------|---------|81| **Setup** | action-init | Initialize backup, session state |82| **Analysis** | action-analyze-requirements | Decompose user request via Gemini CLI |83| **Diagnosis** | action-diagnose-{context,memory,dataflow,agent,docs,token_consumption} | Detect category-specific issues |84| **Deep Analysis** | action-gemini-analysis | Gemini CLI: complex/critical issues |85| **Reporting** | action-generate-report | Consolidate findings → final_report |86| **Fixing** | action-propose-fixes, action-apply-fix | Generate + apply fixes |87| **Verify** | action-verify | Re-run diagnosis, check gates |88| **Exit** | action-complete, action-abort | Finalize or rollback |8990Full action details: [phases/actions/](phases/actions/)9192## State Management9394**Single source of truth**: `.workflow/.scratchpad/skill-tuning-{ts}/state.json`9596```json97{98 "status": "pending|running|completed|failed",99 "target_skill": { "name": "...", "path": "..." },100 "diagnosis": {101 "context": {...},102 "memory": {...},103 "dataflow": {...},104 "agent": {...},105 "docs": {...},106 "token_consumption": {...}107 },108 "issues": [{"id":"...", "severity":"...", "category":"...", "strategy":"..."}],109 "proposed_fixes": [...],110 "applied_fixes": [...],111 "quality_gate": "pass|fail",112 "final_report": "..."113}114```115116See [phases/state-schema.md](phases/state-schema.md) for complete schema.117118## Orchestrator Logic119120See [phases/orchestrator.md](phases/orchestrator.md) for:121- Decision logic (termination checks → action selection)122- State transitions123- Error recovery124125## Key Principles1261271. **Problem-First**: Diagnosis before any fix1282. **Data-Driven**: Record traces, token counts, snapshots1293. **Iterative**: Multiple rounds until quality gates pass1304. **Reversible**: All changes with backup checkpoints1315. **Non-Invasive**: Minimal changes, maximum clarity132133## Usage Examples134135```bash136# Basic skill diagnosis137/skill-tuning "Fix memory leaks in my skill"138139# Deep analysis with Gemini140/skill-tuning "Architecture issues in async workflow"141142# Focus on specific areas143/skill-tuning "Optimize token consumption and fix agent coordination"144145# Custom issue146/skill-tuning "My skill produces inconsistent outputs"147```148149## Output150151After completion, review:152- `.workflow/.scratchpad/skill-tuning-{ts}/state.json` - Full state with final_report153- `state.final_report` - Markdown summary (in state.json)154- `state.applied_fixes` - List of applied fixes with verification results155156## Reference Documents157158| Document | Purpose |159|----------|---------|160| [specs/problem-taxonomy.md](specs/problem-taxonomy.md) | Classification + detection patterns |161| [specs/tuning-strategies.md](specs/tuning-strategies.md) | Fix implementation guide |162| [specs/dimension-mapping.md](specs/dimension-mapping.md) | Dimension ↔ Spec mapping |163| [specs/quality-gates.md](specs/quality-gates.md) | Quality verification criteria |164| [phases/orchestrator.md](phases/orchestrator.md) | Workflow orchestration |165| [phases/state-schema.md](phases/state-schema.md) | State structure definition |166| [phases/actions/](phases/actions/) | Individual action implementations |167168---169> Converted and distributed by [TomeVault](https://tomevault.io/claim/catlog22) — claim your Tome and manage your conversions.170<!-- tomevault:4.0:skill_md:2026-04-11 -->