# Cost Aware Orchestrator

> Интеллектуальный выбор модели/инструмента с учётом цены и сложности задачи. Каждый tool call = деньги. Минимизируй стоимость без потери качества.

- Skill: `zad111ak-ai/cost-aware-orchestrator` (Agent Skill)
- Install (CLI): `npx skillmds@latest add zad111ak-ai/cost-aware-orchestrator`
- Raw SKILL.md: https://api.skillmd.com/api/skills/zad111ak-ai/cost-aware-orchestrator/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: zad111ak-ai (https://skillmd.com/u/zad111ak-ai)
- Updated: 2026-09-21
- Page: https://skillmd.com/skills/zad111ak-ai/cost-aware-orchestrator

---


# Cost-Aware Orchestrator — Оркестратор с учётом стоимости

Активировать: перед каждой задачей, где есть выбор между моделями/инструментами.

**Цель:** Потратить минимум денег на задачу, сохранив качество результата.

---

## Текущая ценовая карта

| Канал | Модель | Input/1M | Output/1M | Для чего |
|-------|--------|----------|-----------|----------|
| **Polza** (DeepSeek V4 Flash) | Основной чат | 26.88₽ | 53.76₽ | Разговор с пользователем, простые задачи |
| **AITunnel** (GPT-5 Nano) | delegation | 0.96₽ | ? | Тяжёлые delegate_task, сложная логика |
| **AITunnel** (Gemini 2.0 Flash Lite) | Рутина | 14.4₽ | 57.6₽ | Средние задачи, ресёрч |
| **AITunnel** (gpt-image-2) | Картинки | — | ~0.86-7.64₽/img | Генерация изображений |

## Decision Tree выбора модели

```
Какой тип задачи?
│
├─ 🔵 Разговор с пользователем
│   → DeepSeek V4 Flash (Polza) — всегда. Это основной канал.
│
├─ 🟢 delegate_task (лёгкая)
│   Признаки: 1-3 шага, простой запрос, чтение данных
│   → DeepSeek V4 Flash (Polza) — нет смысла переключать
│
├─ 🟡 delegate_task (средняя)
│   Признаки: 4-10 шагов, циклы, немного логики
│   → Gemini 2.0 Flash Lite (AITunnel) — 14.4₽ vs 26.88₽
│
├─ 🔴 delegate_task (сложная)
│   Признаки: код с бизнес-логикой, парсинг, анализ данных, многопаговый reasoning
│   → GPT-5 Nano (AITunnel) — 0.96₽, дешевле DeepSeek в 28 раз!
│
├─ 🟣 Генерация изображений
│   → gpt-image-2 (AITunnel) с коротким промптом
│   Совет: промпт ≤50 токенов = ~0.86₽. >100 токенов = ~7.64₽
│
└─ ⚪ Ресёрч / сбор информации
    → Gemini 2.0 Flash Lite (14.4₽) — достаточное качество
```

## Когда НЕ экономить

- **Пользователь явно просит качество** — не экономь
- **Код в production** — лучше потратить 10₽ на ревью, чем 1000₽ на баг
- **Финансовые данные** — точность важнее цены
- **Первая итерация нового подхода** — сделай на лучшей модели, потом шаблонизируй

## Cost Budgeting по задаче

Перед задачей прикинь бюджет:

| Тип задачи | Разумный бюджет | Стоп-лосс |
|------------|----------------|-----------|
| Ответ на вопрос | 1-3₽ | 10₽ |
| Написать код | 5-15₽ | 30₽ |
| Ресёрч | 10-20₽ | 50₽ |
| Генерация картинки | 0.86-3₽ | 10₽ |
| Целая фича | 20-50₽ | 100₽ |

Если бюджет превышен на 50% — остановись и спроси пользователя.

## Cost-Saving Patterns

1. **Bulk через execute_code** — 1 tool call вместо N. Экономия: 50-70% на overhead tool calls
2. **Delegate на дешёвую модель** — для тяжёлой работы. Экономия: до 95%
3. **Короткие промпты для картинок** — 50 токенов vs 200 = 0.86₽ vs 7.64₽
4. **Отложенная верификация** — не проверяй каждый шаг, проверь в конце
5. **Остановись на 80%** — если задача решена на 80%, а добивка стоит 50% бюджета — спроси пользователя
6. **Batch однотипных задач** — 10 задач в одном delegate_task вместо 10 отдельных

## Anti-Patterns

- ❌ **Экономия на спичках** — переключение модели ради задачи на 0.5₽ (overhead переключения > экономии)
- ❌ **Жадность** — послать сложную задачу на дешёвую модель, получить мусор, переделывать (cost ×3)
- ❌ **Забыть про выходные токены** — DeepSeek output (53.76₽) дороже input (26.88₽) в 2 раза
- ❌ **Долгий промпт для картинок** — каждое лишнее слово = деньги

