# Segment Company Search

> Segment prospecting for B2B sales: finds candidate companies in a given niche or hypothesis (e.g. 'medical tourism', 'online English schools', 'car rental services'), verifies each against two strict criteria (segment fit + your ICP signal) and saves a prioritized xlsx (priority signal × company scale). Use when the input is a segment description, NOT a specific company. Output feeds company-context. Skill body is in Russian. Triggers (EN): 'find 30 companies in niche X', 'list candidates in segment Y'. Triggers (RU): «накидай компаний в сфере X», «найди 30 компаний ниши Y», «список площадок в сегменте Z».

- Skill: `marchenko-sales/segment-company-search` (Agent Skill, multi-file: 2 files)
- Install (CLI): `npx skillmds@latest add marchenko-sales/segment-company-search`
- Raw SKILL.md: https://api.skillmd.com/api/skills/marchenko-sales/segment-company-search/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Data & Analytics
- Author: Marchenko-sales (https://skillmd.com/u/marchenko-sales)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/marchenko-sales/segment-company-search

---


# Поиск компаний по сегменту/гипотезе

Ты ищешь компании-кандидаты в клиенты внутри заданного сегмента. Задача не «накидать что попало под тему», а собрать список реальных компаний, каждая из которых проходит жёсткие критерии. Это первый этап воронки: дальше по приоритетным кандидатам собирается досье (company-context) и пишутся первые письма.

## Настройка под твой продукт

Возьми из файла контекста компании (`company-profile.md` в корне проекта, если есть) или спроси у пользователя:

1. **Продукт и ICP:** кому продаём и какую боль закрываем.
2. **Жёсткий ICP-критерий:** признак «нашего» клиента, проверяемый снаружи по сайту компании. Примеры: «аудитория русскоязычная», «есть онлайн-продажи», «B2B-модель», «есть мобильное приложение». Именно он станет критерием 2 ниже.
3. **Приоритетный сигнал:** признак, который делает подходящего кандидата горячим, — по нему строится сортировка списка. Примеры: «нет собственной доставки», «используют конкурента X», «жалобы на текущее решение в свежих отзывах».
4. **Кто не подходит и куда их девать:** признак дисквалификации и что делать с такими (отложить / реферал партнёру).

## Входные данные

- **Сегмент/гипотеза** (обязательно). Формулировка слишком широкая или двусмысленная (например «образование» — школы, онлайн-курсы или репетиторы?) — задай один уточняющий вопрос до старта поиска.
- **Гео** (опционально): не указано — ищи без гео-ограничений.
- **Целевой объём** (опционально, по умолчанию 30+): качество важнее охвата, см. «Правила честности».
- **Файл базы для дедупа** (опционально): выгрузка CRM/таблица уже отработанных компаний.

**Что нужно для работы:** веб-поиск и загрузка страниц — без них скилл не запускай, скажи об этом пользователю. При объёме 30+ кандидатов верификация — самая долгая часть: если среда умеет параллельные подзадачи (субагенты), раскладывай проверку кандидатов на них, дав каждому правило честности и точный чек-лист.

## Два жёстких критерия (должны выполняться ОБА)

1. **Строгое попадание в сегмент.** Компания реально работает в заявленной нише, не смежной и не «около». При сомнении — не включать, а не «натягивать».
2. **ICP-критерий из настройки.** Для каждой компании зафиксируй конкретное, проверяемое доказательство с её сайта, а не предположение: что именно увидел и где. Допустимое исключение — косвенное подтверждение из каталога без захода на сайт: такая компания включается с уверенностью «средняя» (см. этап 3).

Приоритетный сигнал (п. 3 настройки) проверяется попутно, быстро, по открытым источникам — без глубокого дью-дилидженса. Его отсутствие не выкидывает компанию из списка, его наличие поднимает её наверх.

## Этап 1 — декомпозиция сегмента

Прежде чем искать, распиши сегмент на 3–6 конкретных под-типов компаний — это сильно увеличивает охват против одного общего запроса. Пример для «медицинский туризм»: агрегаторы клиник, туроператоры по мед. турам, клиники с международным приёмом, агентства-посредники, страховые сервисы для туристов, консьерж-сервисы.

## Этап 2 — поиск кандидатов (все источники, максимальный охват)

Для каждого под-типа из этапа 1:

- **Поисковые операторы.** Комбинируй ключевые слова под-типа с маркерами твоего ICP-критерия, на языке рынка и на английском. Минимум 3–4 разных формулировки на под-тип, не переиспользуй один запрос.
- **Отраслевые каталоги, рейтинги, агрегаторы ниши.** Ищи готовые списки под конкретный сегмент и проходи по ним, а не выдумывай.
- **Сторы приложений.** У сегмента есть мобильные продукты — ищи в App Store / Google Play по категории и ключевым словам.
- **Страницы «наши клиенты» и кейсы у смежных вендоров.** У конкурентов и у сервисов, работающих с тем же сегментом, часто есть публичные списки клиентов — это готовый пул компаний с подтверждённой потребностью в категории.
- **Отзовики, форумы, соцсети, профильные медиа.** Обсуждения «кто чем пользуется» в сегменте — попутно источник сигналов покупки для следующих этапов.

Не останавливайся на первых 5–10 совпадениях с одного источника: обходи источники по очереди, пока пул кандидатов не станет заметно больше целевого объёма — часть отсеется на верификации.

## Этап 3 — верификация каждого кандидата

Прежде чем включать компанию в список:

- Зайди на сайт (или используй кэш/сниппет, если прямой заход невозможен) и зафиксируй конкретное доказательство критерия 2: что именно увидел («переключатель языка в шапке», «раздел для B2B-клиентов», «цены в такой-то валюте»).
- Раз уже на сайте — проверь приоритетный сигнал и текущего поставщика твоей категории, если он виден снаружи. Заполняй отдельную колонку: это готовая зацепка для первого письма.
- Быстрая оценка масштаба (1–2 источника, глубже не копать): порядок трафика, подписчики соцсетей, загрузки приложения. Фиксируй грубо — «крупная / средняя / малая / не определено» плюс одно основание («~200K визитов/мес», «12K подписчиков»). «Не определено» допустимо и не блокирует включение.
- Убедись, что компания не дубль другого кандидата (разные домены одного бренда) и не действующий клиент пользователя.
- Критерий подтверждён только косвенно (каталог пометил признак, сам сайт не проверялся) — включай с уверенностью «средняя», не «высокая». Шкала уверенности двухуровневая: «высокая» (проверено на сайте) и «средняя» (косвенно); что не дотягивает до «средней» — в файл не идёт, а фиксируется как «на грани».
- Погранично не попадающие компании фиксируй отдельно в чате как «на грани, не включено» — в файл они не идут.

## Этап 4 — дедупликация

Пользователь приложил файл базы — прочитай его, нормализуй домены и названия (без `www.`, протокола, регистра), исключи совпадения по домену или явно по названию+сегменту. Исключённых не выбрасывай молча: отдельный лист «Исключено (дубли)» и число в сводке. Файла нет — так и отметь: «сверка на дубли не выполнялась».

## Этап 5 — сохранение результата (xlsx)

Файл `leads_[сегмент-транслит]_[YYYY-MM-DD].xlsx`.

**Лист 1 «Кандидаты»**, колонки:

| Компания | URL | Под-тип сегмента | Гео | ICP-критерий: доказательство | Текущий поставщик категории (видимый) | Масштаб (оценка + основание) | Приоритетный сигнал | Источник по сигналу | Источник обнаружения | Дата проверки | Уверенность |

**Приоритизация двумерная:** сигнал отвечает на вопрос «наш ли это клиент прямо сейчас», масштаб — «сколько он может принести». Компании с приоритетным сигналом — первым блоком, и ячейки их сигналов выдели заливкой (светло-зелёный, например `C6EFCE`), чтобы приоритет был виден при открытии файла, а не только по сортировке. Как делать заливку — зависит от среды (в Python это openpyxl); если xlsx собрать нечем, сохрани CSV + отдельный md-файл с приоритизированным списком и скажи пользователю, что заливки нет. Внутри блоков — по масштабу (крупные выше), затем по уверенности.

**Лист 2 «Вне ICP (отложено)»** — компании, у которых с источником подтвердился признак дисквалификации из настройки. Это не мусор: если у пользователя есть партнёр для таких лидов — помечай «кандидат на реферал»; в любом случае храни с колонкой «что перепроверить в будущем» (признаки меняются: компании открывают новые юрлица, направления, каналы).

**Лист 3 «Исключено (дубли)»** — только если была сверка с базой.

## Сводка в чате (после файла)

Коротко, без дублирования таблицы:
- Сегмент и под-типы, по которым шёл поиск.
- Сколько рассмотрено всего / прошло оба критерия / исключено как дубли / «на грани» не вошло.
- Сколько кандидатов с приоритетным сигналом и сколько среди них крупных — с них начинать следующий этап.
- Напоминание: оценки сигналов предварительные, по открытым источникам; перепроверяются при сборе досье.

## Правила честности (важнее охвата)

Несуществующая или чужая по сегменту компания в списке стоит дороже, чем её отсутствие: время на досье и письмо потрачено впустую, а рассылка мимо ЦА бьёт по репутации домена и бренда.

- НЕ выдумывай компании и URL. Каждая строка — с реальным источником обнаружения.
- НЕ включай компанию, если хотя бы один из двух критериев не подтверждён — ни один не компенсирует другой.
- Набралось меньше целевого объёма — так и скажи в сводке и не разбавляй список слабыми совпадениями ради цифры. Маленький точный список сильнее большого с мусором.
- Сегмент оказался настолько узким, что кандидатов физически мало, — скажи прямо: для проверки гипотезы это тоже результат.
- У каждого кандидата — дата проверки; при повторном запуске через несколько месяцев старые данные не считаются актуальными автоматически.

## Правила запуска

- Один запуск = один сегмент. Пользователь дал несколько — спроси, вести ли их отдельными листами или отдельными запусками, не решай молча.
- Результат — готовый вход для company-context: строка «Компания + URL» подаётся туда как есть.

