Cross-Source Verify — движок круговой сверки
Последняя миля любой проверки: сырые результаты из N источников → один связный ответ, которому можно доверять, с явной оценкой уверенности и показанными расхождениями.
Один источник звучит уверенно и часто врёт. Агрегатор отдаёт ровную карточку с точными числами — и ты веришь, потому что цифра конкретная. Но конкретная ≠ верная: у соседнего агрегатора по той же компании число другое, а ты этого не видишь, пока не откроешь оба. Этот движок открывает все сразу и сводит — не выбирая молча одну версию, а показывая, где источники согласны (это и есть факт), а где разошлись (это флаг).
Принцип (POV), доказан вживую 15.06.2026. Прогнали одну компанию через 5 агрегаторов: число судов разошлось почти втрое (примерно ~500 / ~1000 / ~1500 — разная методология), при этом выручка и ФССП совпали у всех. Вывод движка: один источник = единая точка отказа и ложная точность. Факт = совпадение у ≥3; расхождение = разброс, а не выбор одной цифры. Совпало → уверенность; разошлось → флаг. (Цифры округлены; проверяйте сами.)
Шкала авторитетности источников (РФ)
| Уровень |
Источники |
Вес |
| Highest — первоисточник |
Госреестры: ЕГРЮЛ/ЕГРИП ФНС, ГИР БО, kad.arbitr, ФССП, ЕФРСБ/Федресурс, нормативка (НК/ГК/ТК), официальная документация |
максимальный |
| High — официальная сводка |
Прозрачный бизнес ФНС, реестры ЦБ/Роскомнадзора, рецензируемые статьи, первичная отчётность |
высокий |
| Moderate — агрегатор (проверенный) |
checko, rusprofile, saby/СБИС, audit-it — собирают из официальных, но добавляют свою методологию/скоринг |
средний, кросс-сверять |
| Low-moderate — агрегатор (шумный) |
list-org (подмешивает чужие сигналы), отраслевые порталы, экспертные блоги |
проверять принадлежность данных |
| Low — неподтверждённое |
форумы, отзывы, маркетинг, агрегаторы новостей, соцсети |
только как гипотеза |
| Unverified — со слов |
данные, которые дал пользователь как истину |
помечать «не верифицировано» |
Оценка уверенности = свежесть × авторитет × согласие
Свежесть: у каждого факта — дата источника. Свежее (сегодня/неделя) → высокая уверенность для статусных данных; устаревшее (месяцы) → понизить, пометить «возможно неактуально». Пример из практики: audit-it отдавал 2023, когда другие 2024 — бери самый свежий год.
Авторитет: по таблице выше. Госреестр > агрегатор > форум.
Согласие (главное в круговой сверке):
- Совпало у ≥3 источников → ✅ высокая уверенность, давай прямым утверждением.
- Разошлось (разные цифры/оценки) → ⚠️ покажи разброс и не выдавай одну цифру за факт. Пример: число судов у одной компании — примерно ~500 / ~1000 / ~1500 у разных агрегаторов (разная методология подсчёта) → «по разным источникам от ~500 до ~1500 дел, методики счёта различаются».
- Сигнал только в одном источнике → проверь принадлежность (особенно тревожный: банкротство, суд, долг — у list-org бывают чужие). Не пугай, пока не подтвердил.
Дедупликация
Одна и та же информация часто в нескольких местах. Сливай:
- Сигналы дубля: тот же текст/сущность (ИНН, ОГРН, имя), близкие даты, один источник ссылается на другой.
- Приоритет при слиянии: полнота (самая полная версия) > авторитет (госреестр > агрегатор) > свежесть (последнее обновление).
- НЕ сливать: разные выводы по той же теме, разные точки зрения, эволюция данных (v1 vs v2), разные периоды.
Конфликт — показывать, не прятать
Когда источники расходятся — выводи явно, не выбирай молча:
Расхождение источников по [параметр]:
- [источник A, дата, tier]: значение X
- [источник B, дата, tier]: значение Y
Вероятная причина: [разная методология / устарело / чужие данные].
Наиболее надёжно: [вывод по авторитету+свежести] — но проверьте, если критично.
Атрибуция — каждый факт к источнику
Каждое утверждение → источник + дата + tier-маркер (✅ подтверждено Tier 1-2 / ⚠️ частично / ❌ не подтверждено). В конце — список источников. Никаких чисел без происхождения.
Как работает
[Запрос] → определи тип (факт / статус / сущность / решение)
↓
[Декомпозиция] → какие источники релевантны, что у каждого спросить (параллельно)
↓
[Сбор] → собери из ≥3 источников (агрегаторы/реестры/веб)
↓
[Дедуп] → слей дубли по приоритету полнота>авторитет>свежесть
↓
[Уверенность] → свежесть × авторитет × согласие на каждый факт
↓
[Синтез] → связный ответ, ведёт вывод (не методология), конфликты явно, атрибуция + tier
Anti-patterns
- НЕ перечисляй по источникам («у checko… у list-org…») — сведи в нарратив по фактам.
- НЕ выдавай одну цифру, когда источники расходятся — покажи разброс.
- НЕ давай одиночному сигналу тот же вес, что подтверждённому ≥3.
- НЕ прячь конфликт. НЕ опускай атрибуцию. НЕ пугай непроверенным сигналом.
Формат вывода
Единый формат killer-карточки (общий для counterparty-guard / tax-calendar-proactive / cross-source-verify): шапка {эмодзи} {что} — на {дата} → вердикт (✅ согласовано / ⚠️ расхождение) → факты по существу → футер Что проверено: (источник + дата + tier) и Что НЕ проверено:. Один узнаваемый вид во всех стеках (markdown, без host-specific вёрстки).
Пример (иллюстративный)
Запрос: «Сколько судов у этого контрагента?» Собрано из 4 агрегаторов.
Плохо (одиночный источник): «~1500 судебных дел» — берём самый высокий счётчик, звучит точно. На деле он подмешал чужие эпизоды, а методология у всех разная.
Хорошо (круговая сверка):
🔎 Сверка: контрагент {ИНН} — на 15.06.2026
⚠️ Расхождение по числу судов — единой цифре верить нельзя.
Суды: по разным источникам от ~500 до ~1500 дел — методики подсчёта различаются
(примерно ~500 / ~1000 / ~1500 у трёх агрегаторов). Надёжнее ориентироваться
на нижнюю-среднюю оценку; точное число — в kad.arbitr.
ФССП: совпало у всех источников — ✅ высокая уверенность.
Выручка: совпала у всех — ✅ Tier 1 (ГИР БО).
Что проверено: 4 агрегатора + ГИР БО (15.06.2026); ФССП/выручка — ✅ совпали ≥3.
Что НЕ проверено: точное число судов — только kad.arbitr вручную.
Разница: вместо ложно-точной цифры — честный разброс там, где источники спорят, и твёрдое утверждение там, где совпали.
Кто использует движок
- counterparty-guard — 5 агрегаторов по контрагенту (основной потребитель, отсюда родился).
- competitor-scout — сбор по конкурентам из разных площадок.
- факт-чек любого скилла — числа/цитаты с tier (по умолчанию из CLAUDE.md).
- Любой скилл, где >1 источника сводится в ответ.
Основа — Anthropic enterprise-search/knowledge-synthesis, адаптировано под РФ-источники и tier-протокол тандема.
Changelog
- 0.2.1 (16.06.2026) — единый формат killer-карточки (шапка с датой → вердикт согласовано/расхождение → факты → футер Что проверено/НЕ проверено), общий с counterparty-guard и tax-calendar-proactive; пример обёрнут в карточку.
- 0.2 (15.06.2026) — упаковка: hero про ложную точность одиночного источника, POV-пруф вынесен наверх (живой тест 5 агрегаторов), worked-пример «плохо/хорошо».
- 0.1 — движок круговой сверки: шкала авторитетности РФ, уверенность = свежесть × авторитет × согласие, дедуп, явный показ конфликтов, атрибуция с tier.
1---2name: cross-source-verify3description: Движок круговой сверки: берёт результаты из НЕСКОЛЬКИХ источников (агрегаторы, госреестры, веб, выгрузки) и сводит в один ответ с дедупликацией, оценкой уверенности (свежесть × авторитет × согласие источников), tier-маркерами и явным показом расхождений. Не выбирает молча одну версию — показывает конфликт. Переиспользуемое ядро под counterparty-guard, competitor-scout, факт-чек, любой скилл с несколькими источниками. Адаптация enterprise-search/knowledge-synthesis под РФ-источники + опыт мульти-агрегаторной проверки. Триггеры: «проверь через несколько источников», «круговая сверка», «насколько достоверно», «сведи данные из источников», «где правда».4---56<!-- Производное от Anthropic knowledge-work-plugins / enterprise-search (Apache-2.0, (c) Anthropic). Локализовано под РФ, файл изменён. См. /NOTICE и /LICENSE. -->78# Cross-Source Verify — движок круговой сверки910> Последняя миля любой проверки: сырые результаты из N источников → один связный ответ, которому можно доверять, с явной оценкой уверенности и показанными расхождениями.1112Один источник звучит уверенно и часто врёт. Агрегатор отдаёт ровную карточку с точными числами — и ты веришь, потому что цифра конкретная. Но конкретная ≠ верная: у соседнего агрегатора по той же компании число другое, а ты этого не видишь, пока не откроешь оба. Этот движок открывает все сразу и сводит — не выбирая молча одну версию, а показывая, где источники согласны (это и есть факт), а где разошлись (это флаг).1314> **Принцип (POV), доказан вживую 15.06.2026.** Прогнали одну компанию через 5 агрегаторов: число судов разошлось почти втрое (примерно ~500 / ~1000 / ~1500 — разная методология), при этом выручка и ФССП совпали у всех. Вывод движка: **один источник = единая точка отказа и ложная точность. Факт = совпадение у ≥3; расхождение = разброс, а не выбор одной цифры.** Совпало → уверенность; разошлось → флаг. (Цифры округлены; проверяйте сами.)1516## Шкала авторитетности источников (РФ)1718| Уровень | Источники | Вес |19|---|---|---|20| **Highest** — первоисточник | Госреестры: ЕГРЮЛ/ЕГРИП ФНС, ГИР БО, kad.arbitr, ФССП, ЕФРСБ/Федресурс, нормативка (НК/ГК/ТК), официальная документация | максимальный |21| **High** — официальная сводка | Прозрачный бизнес ФНС, реестры ЦБ/Роскомнадзора, рецензируемые статьи, первичная отчётность | высокий |22| **Moderate** — агрегатор (проверенный) | checko, rusprofile, saby/СБИС, audit-it — собирают из официальных, но добавляют свою методологию/скоринг | средний, кросс-сверять |23| **Low-moderate** — агрегатор (шумный) | list-org (подмешивает чужие сигналы), отраслевые порталы, экспертные блоги | проверять принадлежность данных |24| **Low** — неподтверждённое | форумы, отзывы, маркетинг, агрегаторы новостей, соцсети | только как гипотеза |25| **Unverified** — со слов | данные, которые дал пользователь как истину | помечать «не верифицировано» |2627## Оценка уверенности = свежесть × авторитет × согласие2829**Свежесть:** у каждого факта — дата источника. Свежее (сегодня/неделя) → высокая уверенность для статусных данных; устаревшее (месяцы) → понизить, пометить «возможно неактуально». Пример из практики: audit-it отдавал 2023, когда другие 2024 — бери самый свежий год.3031**Авторитет:** по таблице выше. Госреестр > агрегатор > форум.3233**Согласие (главное в круговой сверке):**34- **Совпало у ≥3 источников** → ✅ высокая уверенность, давай прямым утверждением.35- **Разошлось** (разные цифры/оценки) → ⚠️ покажи разброс и не выдавай одну цифру за факт. Пример: число судов у одной компании — примерно ~500 / ~1000 / ~1500 у разных агрегаторов (разная методология подсчёта) → «по разным источникам от ~500 до ~1500 дел, методики счёта различаются».36- **Сигнал только в одном источнике** → проверь принадлежность (особенно тревожный: банкротство, суд, долг — у list-org бывают чужие). Не пугай, пока не подтвердил.3738## Дедупликация3940Одна и та же информация часто в нескольких местах. Сливай:41- **Сигналы дубля:** тот же текст/сущность (ИНН, ОГРН, имя), близкие даты, один источник ссылается на другой.42- **Приоритет при слиянии:** полнота (самая полная версия) > авторитет (госреестр > агрегатор) > свежесть (последнее обновление).43- **НЕ сливать:** разные выводы по той же теме, разные точки зрения, эволюция данных (v1 vs v2), разные периоды.4445## Конфликт — показывать, не прятать4647Когда источники расходятся — выводи явно, не выбирай молча:48```49Расхождение источников по [параметр]:50- [источник A, дата, tier]: значение X51- [источник B, дата, tier]: значение Y52Вероятная причина: [разная методология / устарело / чужие данные].53Наиболее надёжно: [вывод по авторитету+свежести] — но проверьте, если критично.54```5556## Атрибуция — каждый факт к источнику5758Каждое утверждение → источник + дата + tier-маркер (✅ подтверждено Tier 1-2 / ⚠️ частично / ❌ не подтверждено). В конце — список источников. Никаких чисел без происхождения.5960## Как работает6162```63[Запрос] → определи тип (факт / статус / сущность / решение)64 ↓65[Декомпозиция] → какие источники релевантны, что у каждого спросить (параллельно)66 ↓67[Сбор] → собери из ≥3 источников (агрегаторы/реестры/веб)68 ↓69[Дедуп] → слей дубли по приоритету полнота>авторитет>свежесть70 ↓71[Уверенность] → свежесть × авторитет × согласие на каждый факт72 ↓73[Синтез] → связный ответ, ведёт вывод (не методология), конфликты явно, атрибуция + tier74```7576## Anti-patterns7778- НЕ перечисляй по источникам («у checko… у list-org…») — сведи в нарратив по фактам.79- НЕ выдавай одну цифру, когда источники расходятся — покажи разброс.80- НЕ давай одиночному сигналу тот же вес, что подтверждённому ≥3.81- НЕ прячь конфликт. НЕ опускай атрибуцию. НЕ пугай непроверенным сигналом.8283## Формат вывода8485> **Единый формат killer-карточки** (общий для counterparty-guard / tax-calendar-proactive / cross-source-verify): шапка `{эмодзи} {что} — на {дата}` → вердикт (✅ согласовано / ⚠️ расхождение) → факты по существу → футер `Что проверено:` (источник + дата + tier) и `Что НЕ проверено:`. Один узнаваемый вид во всех стеках (markdown, без host-specific вёрстки).8687## Пример (иллюстративный)8889**Запрос:** «Сколько судов у этого контрагента?» Собрано из 4 агрегаторов.9091**Плохо (одиночный источник):** «~1500 судебных дел» — берём самый высокий счётчик, звучит точно. На деле он подмешал чужие эпизоды, а методология у всех разная.9293**Хорошо (круговая сверка):**94```95🔎 Сверка: контрагент {ИНН} — на 15.06.20269697⚠️ Расхождение по числу судов — единой цифре верить нельзя.9899Суды: по разным источникам от ~500 до ~1500 дел — методики подсчёта различаются100 (примерно ~500 / ~1000 / ~1500 у трёх агрегаторов). Надёжнее ориентироваться101 на нижнюю-среднюю оценку; точное число — в kad.arbitr.102ФССП: совпало у всех источников — ✅ высокая уверенность.103Выручка: совпала у всех — ✅ Tier 1 (ГИР БО).104105Что проверено: 4 агрегатора + ГИР БО (15.06.2026); ФССП/выручка — ✅ совпали ≥3.106Что НЕ проверено: точное число судов — только kad.arbitr вручную.107```108Разница: вместо ложно-точной цифры — честный разброс там, где источники спорят, и твёрдое утверждение там, где совпали.109110## Кто использует движок111112- **counterparty-guard** — 5 агрегаторов по контрагенту (основной потребитель, отсюда родился).113- **competitor-scout** — сбор по конкурентам из разных площадок.114- **факт-чек любого скилла** — числа/цитаты с tier (по умолчанию из CLAUDE.md).115- Любой скилл, где >1 источника сводится в ответ.116117Основа — Anthropic enterprise-search/knowledge-synthesis, адаптировано под РФ-источники и tier-протокол тандема.118119## Changelog120- **0.2.1** (16.06.2026) — единый формат killer-карточки (шапка с датой → вердикт согласовано/расхождение → факты → футер Что проверено/НЕ проверено), общий с counterparty-guard и tax-calendar-proactive; пример обёрнут в карточку.121- **0.2** (15.06.2026) — упаковка: hero про ложную точность одиночного источника, POV-пруф вынесен наверх (живой тест 5 агрегаторов), worked-пример «плохо/хорошо».122- **0.1** — движок круговой сверки: шкала авторитетности РФ, уверенность = свежесть × авторитет × согласие, дедуп, явный показ конфликтов, атрибуция с tier.