ai-work-result-evaluation
Если приёмка запускает существенную правку источника истины, сначала требуется
ai-work-control/full; сама приёмка не заменяет этот контроль.
Этот навык применяется для проверки качества результата ИИ перед его принятием,
публикацией или повторным использованием.
Обязательный порядок
- Определи тип результата и поверхность проверки: итоговый ответ, отдельный
шаг, полная траектория, структура артефакта или их сочетание.
- Укажи критерии проверки, метрику и порог пригодности.
- Сравни с базовой линией, если она существует.
- Прогони проверочные случаи, включая отрицательные, а для повторяемых
процедур сохрани опору на проверяемые артефакты запуска: журналы, след
выполнения, метрики, валидаторы или другие результаты прогона.
- Если процедура хорошо определена, сначала используй детерминированную
проверку; оценку через модель или человека добавляй там, где одного
детерминированного правила недостаточно.
- Принять решение:
accept, revise, reject, needs_human_decision.
- Зафиксировать, какие провалы переходят в постоянный набор проверок.
Что должно присутствовать
- список проверяемых сценариев;
- указание, какая поверхность результата проверяется в каждом сценарии;
- причина прохождения или падения каждого сценария;
- проверяемые артефакты или след выполнения, если результат получен через
повторяемую процедуру;
- ссылка на базовую линию;
- решение по дальнейшему использованию результата.
Когда не применять
- если результат не влияет на источник истины и является черновым обсуждением;
- если задача сводится к одномоментной справке без последующей автоматизации;
- если требуется только уточнить формулировки без проверки пригодности.
Границы
- Не заменяет предварительную проверку задачи и контроль запуска. Если перед
работой требовались
ai-work-control или ai-data-collection, они
выполняются до оценки результата.
- Не применим к разовым черновикам без значимых последствий.
Если оценка нужна только для фиксации промежуточного шага, отметь это явно и не
обнуляй решение как принятую версию.
Дополнительно
- См.
references/work-result-evaluation.md.
- Для шаблона случая используй
assets/work-result-evaluation-case-template.md.
1---2name: ai-work-result-evaluation3description: Используй, когда результат ИИ нужно принять, отклонить, опубликовать или использовать как основание следующего шага.4---56# ai-work-result-evaluation78Если приёмка запускает существенную правку источника истины, сначала требуется9`ai-work-control/full`; сама приёмка не заменяет этот контроль.1011Этот навык применяется для проверки качества результата ИИ перед его принятием,12публикацией или повторным использованием.1314## Обязательный порядок15161. Определи тип результата и поверхность проверки: итоговый ответ, отдельный17 шаг, полная траектория, структура артефакта или их сочетание.182. Укажи критерии проверки, метрику и порог пригодности.193. Сравни с базовой линией, если она существует.204. Прогони проверочные случаи, включая отрицательные, а для повторяемых21 процедур сохрани опору на проверяемые артефакты запуска: журналы, след22 выполнения, метрики, валидаторы или другие результаты прогона.235. Если процедура хорошо определена, сначала используй детерминированную24 проверку; оценку через модель или человека добавляй там, где одного25 детерминированного правила недостаточно.266. Принять решение: `accept`, `revise`, `reject`, `needs_human_decision`.277. Зафиксировать, какие провалы переходят в постоянный набор проверок.2829## Что должно присутствовать3031- список проверяемых сценариев;32- указание, какая поверхность результата проверяется в каждом сценарии;33- причина прохождения или падения каждого сценария;34- проверяемые артефакты или след выполнения, если результат получен через35 повторяемую процедуру;36- ссылка на базовую линию;37- решение по дальнейшему использованию результата.3839## Когда не применять4041- если результат не влияет на источник истины и является черновым обсуждением;42- если задача сводится к одномоментной справке без последующей автоматизации;43- если требуется только уточнить формулировки без проверки пригодности.4445## Границы4647- Не заменяет предварительную проверку задачи и контроль запуска. Если перед48 работой требовались `ai-work-control` или `ai-data-collection`, они49 выполняются до оценки результата.50- Не применим к разовым черновикам без значимых последствий.5152Если оценка нужна только для фиксации промежуточного шага, отметь это явно и не53обнуляй решение как принятую версию.5455## Дополнительно5657- См. `references/work-result-evaluation.md`.58- Для шаблона случая используй `assets/work-result-evaluation-case-template.md`.