# Enterprise Clone Builder

> 企业数字分身建库工具。从企业名称 + 本地资料 + 公开信息出发，一次性构建一个完整的、标准化的企业分身仓库（AGENTS.md + 企业画像 + 内容资产 + 文风样本 + 调研记录），该仓库可直接被 enterprise-clone-writer 消费进行内容写作。 **强触发场景**： - 「给这家企业建一个数字分身」「构建企业分身仓库」 - 「把这家企业的资料整理成 AI 能用的分身」 - 交付团队需要标准化地给客户企业建分身 **不要用在**： - 分身仓库已建好后的写作任务（用 enterprise-clone-writer） - 个人创作者写作分身（用 writing-clone-profile） - 只是整理企业资料但不建分身仓库

- Skill: `zjp1997720/enterprise-clone-builder` (Agent Skill, multi-file: 8 files)
- Install (CLI): `npx skillmds@latest add zjp1997720/enterprise-clone-builder`
- Raw SKILL.md: https://api.skillmd.com/api/skills/zjp1997720/enterprise-clone-builder/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: zjp1997720 (https://skillmd.com/u/zjp1997720)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/zjp1997720/enterprise-clone-builder

---


# Enterprise Clone Builder

## 这是什么

企业分身的建库工具。输入企业名称和资料，输出一个完整的、标准化的分身仓库。

一句话：**builder 建库，writer 写作。builder 产出的仓库，直接被 enterprise-clone-writer 消费。**

## 使用者

智见AI交付团队（大鹏或团队成员）。使用者是专业人士，不是企业客户。

客户买的是建好的分身成品。builder 是生产工具，不是交付给客户的自助工具。

---

## 输入参数

| 参数 | 必填 | 说明 |
|---|---|---|
| 企业名称 | 是 | 全称，用于创建仓库目录和联网搜索 |
| 官网URL | 否 | 有则抓取官网，无则跳过 |
| 本地资料路径 | 否 | 客户提供的资料文件夹路径 |
| 输出路径 | 否 | 默认当前目录下创建 `{企业名}-企业分身/` |

如果有本地资料路径，**本地资料优先于联网调研**——最好的资料永远在企业本地。

---

## 主流程

### Step 0：初始化 + 本地资料盘点

**0.1 创建标准目录结构**

根据企业名称创建仓库根目录和全部子目录。目录规范见 `references/directory-spec.md`。

**0.2 扫描本地资料**

如果提供了本地资料路径：
1. 递归扫描该目录下所有文件
2. 识别文件格式（PDF / Word / Excel / PPT / 图片 / Markdown / 纯文本）
3. 读取可读文件的前500字，判断内容类型
4. 按内容类型归档到 `02-原始素材/本地资料/` 下对应子目录

智能分类规则见 `references/local-intake-guide.md`。

无法确定类型的文件归入 `本地资料/未分类/`，在盘点报告中标注。

**0.3 诊断覆盖度**

扫描完所有文件后，输出7个维度的覆盖度报告：

| 维度 | 判定标准 |
|---|---|
| 充足 | 3个以上文件 |
| 不足 | 1-2个文件 |
| 缺失 | 0个文件 |

**0.4 输出资料盘点报告**

在 `05-调研记录/` 下生成 `资料盘点报告.md`，记录扫描结果、归档情况和缺口诊断。

如果 `--interactive` 模式，在这里停下来，让用户确认或补充后再继续。

### Step 1：联网补充调研

**只补 Step 0 诊断出的缺口**，不全量抓取。

1. 用 web-clipper 抓取官网（如有URL）
   - 官网首页
   - 产品列表页 → 从中提取子链接 → 抓代表性产品详情（10-20个）
   - 新闻列表页 → 从中提取子链接 → 抓代表性新闻详情（10-20条）
2. 搜索企业名称，抓取第三方平台信息
3. 根据缺口针对性补充：对外发声不足→重点抓新闻；产品不足→重点抓产品页
4. 所有抓取文件登记到 `02-原始素材/source-map.md`

如果企业太小、互联网上几乎没有信息：标注"公开信息不足，分身质量依赖本地资料"，继续。

web-clipper 调用方式见 `references/web-clipper-usage.md`。

### Step 2：结构化提取

从全部素材（本地 + 联网）提取，写入企业画像和内容资产。

**2.1 企业画像 5 维度** → `01-企业画像/`

| 文件 | 提取内容 |
|---|---|
| 01-基本信息.md | 工商、规模、地址、联系方式 |
| 02-产品与服务.md | 产品线分类、核心技术、应用场景 |
| 03-客户与市场.md | 目标客户、行业分布、竞争格局 |
| 04-品牌调性.md | 品牌声音、表达风格、禁用表达 |
| 05-发展历程.md | 创立时间、关键节点 |

**2.2 内容资产 4 库** → `03-内容资产/`

| 文件 | 提取内容 |
|---|---|
| 产品描述库.md | 每个产品标准化描述（型号/参数/用途/卖点/来源） |
| 客户案例库.md | 客户案例和应用场景 |
| 技术知识库.md | 行业背景、技术原理、标准 |
| 品牌素材.md | slogan、简介、标准文案、营销话术 |

**2.3 来源标注**

所有提取的信息标注来源文件。区分"有证据的"和"推断的"。写入 `05-调研记录/claims-ledger.md`。

详细提取规范见 `references/extraction-guide.md`。

### Step 3：文风分析

**3.1 选代表性文章**

从对外发声类素材中选 3-5 篇代表性文章。优先级：本地公众号文章 > 官网新闻 > 第三方平台。

选择标准见 `references/voice-analysis-guide.md`。

**3.2 蒸馏文风特征** → `04-文风样本/voice-cues.md`

提取维度：语气与人设、自称方式、句式与节奏、用词特征、结构偏好、产品描述风格、禁用表达。每条附原文证据。

**3.3 归一化范文** → `04-文风样本/form-normalized-anchors/`

选 1-2 篇做归一化处理（清理格式、统一标题层级）。

**3.4 原始范文锚点** → `04-文风样本/voice-anchors.md`

收录 3-5 篇代表性文章的全文或关键段落。

**3.5 文风置信度**

对外发声素材不足 3 篇时，在 voice-cues.md 标注"文风置信度低，基于有限样本推断"。

### Step 4：建库

**4.1 AGENTS.md**

基于企业画像和品牌调性生成分身的系统提示词。包含：身份认同、企业最小画像、核心产品线、表达原则、工作规则（读取路径、质量底线、产出归档规范）、快速路由。

**4.2 00-企业概览.md**

一页纸速查：基本信息表、产品线一览、客户与市场、多平台展示、发展关键节点、文风速查、事实红线。

**4.3 README.md**

仓库说明 + 目录结构 + 使用指南 + 模板复用说明。

**4.4 调研记录三件套** → `05-调研记录/`

- `claims-ledger.md`：所有事实断言的来源和置信度
- `gap-report.md`：已解决缺口 + 仍存在缺口
- `调研日志.md`：建库过程记录

**4.5 source-map.md** → `02-原始素材/source-map.md`

所有素材（本地 + 联网）的来源地图。

---

## 完成标准

建库完成的标志是以下文件全部存在且非空：

```
AGENTS.md                          ✓
00-企业概览.md                      ✓
01-企业画像/01-基本信息.md          ✓
01-企业画像/02-产品与服务.md        ✓
01-企业画像/03-客户与市场.md        ✓
01-企业画像/04-品牌调性.md          ✓
01-企业画像/05-发展历程.md          ✓
03-内容资产/产品描述库.md           ✓
03-内容资产/客户案例库.md           ✓
03-内容资产/技术知识库.md           ✓
03-内容资产/品牌素材.md             ✓
04-文风样本/voice-anchors.md        ✓
04-文风样本/voice-cues.md           ✓
05-调研记录/claims-ledger.md        ✓
05-调研记录/gap-report.md           ✓
05-调研记录/调研日志.md             ✓
02-原始素材/source-map.md           ✓
06-产出/                            ✓（空目录，留给writer）
```

README.md 可选（如果时间紧可后补）。

---

## 运行模式

**默认：全自动**

一口气跑完 Step 0 → 4，最后输出完整仓库 + 资料盘点报告。

**分段模式：`--interactive`**

每步结束停下来汇报：
- Step 0 后：展示资料覆盖度报告，确认缺口
- Step 1 后：展示抓取结果和素材量
- Step 2 后：展示画像要点，确认准确度
- Step 3 后：展示文风特征摘要

用户确认后继续下一步。

---

## 使用 subagent 提速

这个 skill 的 Step 1（抓取）和 Step 2（提取）适合用 subagent 并行执行：

- Step 0 完成后，Step 1 可以拆多个 subagent 同时抓不同来源
- Step 1 完成后，Step 2 的企业画像提取、内容资产填充、文风分析可以并行
- Step 4 的 AGENTS.md、概览、质量文件也可以并行写

实战建议：3-4个subagent并行可以把建库时间从大半天压缩到1-2小时。

---

## 与 enterprise-clone-writer 的对接

builder 产出的仓库是 writer 的读取约定：

| writer读取 | builder产出 |
|---|---|
| AGENTS.md | Step 4.1 |
| 01-企业画像/04-品牌调性.md | Step 2.1 |
| 04-文风样本/voice-cues.md | Step 3.2 |
| 03-内容资产/*.md | Step 2.2 |

两者通过目录结构约定松耦合。writer 不直接调用 builder。

---

## 适用边界

**适合**：
- 有一定历史积累（3年以上）的企业
- 有本地资料沉淀（产品文档、历史内容、客户案例等）
- 还没有系统化数字化的企业

**不适合**：
- 本地无资料、互联网上也几乎没有信息的小企业
- 刚成立没有任何资料积累的企业

---

## 不做

- 不做写作（交给 enterprise-clone-writer）
- 不做 PPT 生成（交给 zhijian-ai-visual-deck）
- 不做客户交付包装
- 不做数字人视频
- 不引导 AI 小白用户

---

## 文件职责

- `SKILL.md`（本文件）：主入口，流程、输入、输出、完成标准
- `references/directory-spec.md`：标准目录结构规范
- `references/local-intake-guide.md`：本地资料智能分类规则 + 客户收集清单
- `references/extraction-guide.md`：结构化提取规范
- `references/voice-analysis-guide.md`：文风分析操作指南
- `references/web-clipper-usage.md`：web-clipper 调用方式

原则：**以 SKILL.md 为准。references 是展开说明。**

---

## 客户资料收集清单

建库前，可以把 `references/local-intake-guide.md` 里的收集清单导出发给客户，让客户提前按清单整理资料文件夹。

清单包含 7 类资料（企业介绍/产品资料/客户案例/对外发声/销售服务/行业知识/品牌视觉），每类注明需要什么文件、举例和优先级。

客户整理完资料后，指向那个文件夹启动 skill 即可。

---

_最后更新：2026-07-08_

