# Analyze Document

> Анализ загруженных файлов. Загрузи этот skill когда пользователь загрузил файл и просит его проанализировать.

- Skill: `engsimsoft/analyze-document` (Agent Skill)
- Install (CLI): `npx skillmds@latest add engsimsoft/analyze-document`
- Raw SKILL.md: https://api.skillmd.com/api/skills/engsimsoft/analyze-document/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: engsimsoft (https://skillmd.com/u/engsimsoft)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/engsimsoft/analyze-document

---


# Анализ документов

## Как файлы попадают в контекст

Пользователь прикрепляет файл через интерфейс чата. Simply сам решает как доставить содержимое до модели — тебе **не нужно** вызывать никакие инструменты для чтения вложений. Pipeline загрузки:

| Тип файла | Как приходит к тебе |
|-----------|---------------------|
| .txt, .md, .docx, .csv, **.pdf (текстовый)** | Содержимое уже **inline в промпте** как текст (конвертация при загрузке + `convertTextFilesInAllMessages` в pipeline) |
| .pdf (сканированный), .jpg, .png | Файл-аттачмент, маршрутизируется в vision-модель (Claude Haiku 4.5). Ты его видишь нативно — просто читай и анализируй |
| .xlsx, .xls | Инструмент `parseExcel` — вызови его с именем файла, чтобы получить структурированные данные |

Никакого отдельного «открытия файла» через tool call для текстовых, DOCX, PDF или изображений не требуется. Если файл уже во входящем сообщении — значит его содержимое уже доступно тебе.

**Замечание про PDF:** Текстовые PDF (обычные документы: контракты, отчёты, руководства) извлекаются в текст при загрузке — ты видишь их как обычный inline-текст. Сканированные PDF (фото документа, скан) остаются файлом и обрабатываются vision-моделью. Если PDF был большим и обрезан — в конце извлечённого текста будет маркер `[содержимое обрезано, показаны первые N символов из M, всего страниц: K]`.

## Процесс работы

### 1. Определи что тебе нужно

Прочитай запрос пользователя — что именно он просит? Резюме? Поиск конкретных данных? Сравнение? Аномалии?

### 2. Прочитай содержимое

- **Текст/DOCX/PDF/изображения** — уже в контексте, начинай анализировать сразу
- **Excel/CSV-таблицы** (.xlsx, .xls) — один вызов `parseExcel` с filename

### 3. Проанализируй

**Для текстовых документов:**
- Выдели ключевые тезисы
- Найди запрошенную информацию
- Сделай краткое резюме

**Для таблиц:**
- Посмотри структуру (колонки, строки)
- Посчитай базовую статистику (сумма, среднее, мин/макс)
- Найди аномалии или паттерны

### 4. Представь результат

- Сначала краткий вывод (1-2 предложения)
- Потом детали (если нужны)
- Предложи следующие шаги

## Типичные запросы

| Запрос | Что делать |
|--------|------------|
| "Что тут написано?" | Краткое резюме |
| "Найди все даты" | Извлечение конкретных данных |
| "Сколько всего?" | Подсчёт, суммирование |
| "Что не так?" | Поиск ошибок, аномалий |
| "Сравни с..." | Сравнительный анализ |

## Ограничения

- Очень большие таблицы могут не помещаться полностью — в таком случае работай с первыми N строками и сообщи об этом
- Сложное форматирование DOCX (таблицы внутри текста, сноски) может теряться — структура текста сохраняется, разметка упрощается

