# AI Work Result Evaluation

> Используй, когда результат ИИ нужно принять, отклонить, опубликовать или использовать как основание следующего шага.

- Skill: `mekras/ai-work-result-evaluation` (Agent Skill, multi-file: 7 files)
- Install (CLI): `npx skillmds@latest add mekras/ai-work-result-evaluation`
- Raw SKILL.md: https://api.skillmd.com/api/skills/mekras/ai-work-result-evaluation/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: mekras (https://skillmd.com/u/mekras)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/mekras/ai-work-result-evaluation

---


# ai-work-result-evaluation

Если приёмка запускает существенную правку источника истины, сначала требуется
`ai-work-control/full`; сама приёмка не заменяет этот контроль.

Этот навык применяется для проверки качества результата ИИ перед его принятием,
публикацией или повторным использованием.

## Обязательный порядок

1. Определи тип результата и поверхность проверки: итоговый ответ, отдельный
   шаг, полная траектория, структура артефакта или их сочетание.
2. Укажи критерии проверки, метрику и порог пригодности.
3. Сравни с базовой линией, если она существует.
4. Прогони проверочные случаи, включая отрицательные, а для повторяемых
   процедур сохрани опору на проверяемые артефакты запуска: журналы, след
   выполнения, метрики, валидаторы или другие результаты прогона.
5. Если процедура хорошо определена, сначала используй детерминированную
   проверку; оценку через модель или человека добавляй там, где одного
   детерминированного правила недостаточно.
6. Принять решение: `accept`, `revise`, `reject`, `needs_human_decision`.
7. Зафиксировать, какие провалы переходят в постоянный набор проверок.

## Что должно присутствовать

- список проверяемых сценариев;
- указание, какая поверхность результата проверяется в каждом сценарии;
- причина прохождения или падения каждого сценария;
- проверяемые артефакты или след выполнения, если результат получен через
  повторяемую процедуру;
- ссылка на базовую линию;
- решение по дальнейшему использованию результата.

## Когда не применять

- если результат не влияет на источник истины и является черновым обсуждением;
- если задача сводится к одномоментной справке без последующей автоматизации;
- если требуется только уточнить формулировки без проверки пригодности.

## Границы

- Не заменяет предварительную проверку задачи и контроль запуска. Если перед
  работой требовались `ai-work-control` или `ai-data-collection`, они
  выполняются до оценки результата.
- Не применим к разовым черновикам без значимых последствий.

Если оценка нужна только для фиксации промежуточного шага, отметь это явно и не
обнуляй решение как принятую версию.

## Дополнительно

- См. `references/work-result-evaluation.md`.
- Для шаблона случая используй `assets/work-result-evaluation-case-template.md`.

