# Ip Diagram Creator

> Creates a consistent minimalist hand-drawn illustrated character from user-provided photos or profile materials, then generates content visuals like knowledge cards, posters, storyboards, and presentation slides featuring that character alongside helper agents.

- Skill: `haloshin/ip-diagram-creator` (Agent Skill, multi-file: 6 files)
- Install (CLI): `npx skillmds add haloshin/ip-diagram-creator`
- Raw SKILL.md: https://api.skillmd.com/api/skills/haloshin/ip-diagram-creator/raw
- Safety review: PASS (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Design & Media, Productivity, Illustration & Graphics
- Tags: Character Design, Content Visualization, Hand Drawn Illustration, Knowledge Card, Personal Branding, Presentation Slides, Storyboard
- License: MIT
- Author: haloshin (https://skillmd.com/u/haloshin)
- Updated: 2026-08-22
- Page: https://skillmd.com/skills/haloshin/ip-diagram-creator

---


# 个人 IP 图解创作器

用你的 IP 形象，生成专属内容图解。

底层原则：先定角色，再拆内容，最后生成图解。

本 Skill 不是头像生成器，也不是自由风格生图器。它的目标是把用户授权提供的个人材料转成一套可长期复用的极简手绘图解角色，再用这个角色和执行 Agent 一起参与内容表达。

## 推荐运行环境

推荐在支持图片读取、较高推理强度和图像生成工具的 Agent 环境中使用。这样可以直接完成图片读取、角色建档、三张角色资产生成、内容图解生成和返修。

如果当前环境支持 `image_gen`、GPT Image 2 或其他图像生成工具，可以在用户明确说“生成 / 出图 / 直接做图”时直出图片。建议在角色建档、长文拆解、知识卡设计和角色一致性返修时使用较高推理强度。

如果当前环境没有图像生成工具，不要假装已经出图。改为输出可复制到图像生成工具的完整 prompt，并附返修 prompt。

## 环境判断

每次开始前先判断当前能力：

1. 如果有图像生成工具：
   - 用户明确说“生成 / 出图 / 直接做图”时，可以直接生成。
   - 每张图单独生成，不要把多张图拼成一张，除非用户明确要卡组总览。
   - 调用前仍要构造完整 prompt，便于返修和复用。
2. 如果没有图像生成工具：
   - 不直接声称生成了图片。
   - 输出可复制到常见图像生成模型的完整 prompt。
   - 同时输出返修 prompt。
   - 如果用户需要多张资产，分别输出 `01_角色主锚图`、`02_角色规范说明图`、`03_动作_表情_小比例场景扩展图` 三个 prompt。
3. 如果当前模型或环境不能读取图片：
   - 先让用户补充外形描述，或要求上传可读取图片。
   - 不能凭空捏造强相似角色。
4. 如果用户使用低推理或非图像模型：
   - 优先交付结构化角色提取卡、内容确认卡和完整 prompt。
   - 不强行承诺复杂图文编排、角色一致性或图片已生成。

## 用户侧语言

对用户使用这些说法：

- 极简手绘图解角色
- 白底手绘图解
- 动作隐喻
- 图内信息量
- 长文配图
- 图文号知识卡
- 手机海报
- 方法拆解图
- 分镜故事图
- PPT 演讲模式
- 整页 PPT 页面图
- 导演规划卡
- page card
- Agents
- 执行 Agent
- AI 劳动力
- 执行者
- 用户
- 反馈来源

用户可见标题、标签、说明和推荐文本里不要写内部代称。需要表达辅助角色时，按语义写成 Agents、执行 Agent、执行者、用户、失败案例、风险提示或反馈来源。

知识卡模式里，辅助执行 Agent 不是可有可无的装饰。凡是步骤、流程、方法论、对比、案例、风险、行动工单类内容，默认安排 2-6 个执行 Agent，分别承担执行、反馈、错误示范、搬运卡片、标记风险、递交结果等动作；用户 IP 负责主讲、拆解、批注或调度。只有纯观点海报、极简封面或用户明确要求“不要小人 / 不要 Agent”时，才减少或移除。

## 入口判断

先判断用户处在哪个入口：

### A. 用户还没有角色

用户给了本人照片、主页截图、头像、简介、账号资料，或说“帮我做个人 IP 图解角色”时，先进入角色建档。

读取：

- `references/identity-and-character.md`
- `references/visual-language.md`

不要要求用户按表格填写。先从现有材料里提取信息；只有缺少阻塞生成的关键信息时，才追问一个问题。

### B. 用户已有角色

用户已经有角色主锚图、角色规范说明图、动作 / 表情 / 小比例场景扩展图、角色档案、头像或主形象时，跳过角色建档，直接进入内容理解。

读取：

- `references/content-workflow.md`
- `references/modes-and-sizes.md`

### C. 用户只做资产

用户只要头像、动作库、表情、道具组件或视觉组件时，按角色资产任务处理，不进入内容编排。

### D. 用户给内容但没有角色

先提醒需要角色建档。如果用户只想用通用无身份角色，不要强行使用本 Skill 的个人 IP 流程。

### E. PPT 演讲模式

用户已有角色，或明确以自己 / 某个 IP 角色为主视觉，并要求做 PPT、课件、直播分享页、主题演讲、整套演讲页面、按大纲/逐字稿逐页出图时，进入 PPT 演讲模式。

读取：

- `references/ppt-presentation-mode.md`

如果没有确认 IP 角色，先回到角色建档。PPT 演讲模式不服务没有个人 IP 前提的普通商业汇报。

PPT 演讲模式必须先输出整套导演规划卡，用户确认后再做 1-2 页样张，样张确认后才分批生成。不要跳过导演规划直接批量出图。

## 总工作流

```text
阶段 1：角色建档
用户照片 / 主页截图 / 简介 / 一段话
-> 自动提取身份和视觉锚点
-> 输出角色信息提取卡
-> 生成三张角色固定资产
   01_角色主锚图
   02_角色规范说明图
   03_动作_表情_小比例场景扩展图
-> 用户确认 / 返修
-> 固化角色档案

阶段 2：内容理解
长文 / 链接 / 截图 / 课程大纲 / 视频脚本 / 一句话主题
-> 判断输入源类型
-> 拆核心观点、认知转折、适合图解的锚点

阶段 3：视觉模式判断与出图方案推荐
判断手绘插图模式 / 知识卡模式 / PPT 演讲模式
-> 普通内容图：推荐图类型、尺寸、图内信息量、结构类型、角色动作、图内文字
-> PPT 演讲模式：先输出整套导演规划卡

阶段 4：确认卡 / 导演规划确认
普通内容图：输出内容确认卡
PPT 演讲模式：输出导演规划卡，用户确认页数、节奏、密度、人物出现频率

阶段 5：生成与返修
当前环境有图像生成工具时可直接生成
没有图像生成工具时输出可复制 prompt
-> QA 检查
-> 返修
```

## 角色建档规则

读取：

- `references/identity-and-character.md`
- `references/visual-language.md`
- `references/safety-and-assets.md`

角色建档只解决“用户是谁、后续图解里长什么样、怎么动”。不要提前要求用户提供知识点。

输出给用户：

1. **角色信息提取卡**：称呼、领域、简介、气质、识别锚点、职业道具、禁区。
2. **三张角色固定资产 prompt 或图片**：
   - **01 角色主锚图**：后续普通内容图默认主参考。人物要大，发型、眼镜、服装、体态、气质清楚稳定。
   - **02 角色规范说明图**：规则、禁区、配色、道具和纠偏依据。用于用户确认、QA 和返修，不默认每次传给生图模型。
   - **03 动作 / 表情 / 小比例场景扩展图**：复杂动作、表情和大场景小人参考。必须包含小比例场景角色和“主角 + Agent 协作”区，保证人物只占画面 10%-20% 时仍保留识别锚点，也能在知识卡里调度、批注、验收和纠偏。
3. **确认问题**：让用户确认三张资产是否可以作为长期图解角色资产。

未完成角色确认前，不生成内容图解。

角色资产确认后，引用优先级为：

```text
角色主锚图 > 动作/表情/小比例场景扩展图 > 角色规范说明图 > 原始照片 > 临时生成图 > 模型自由发挥
```

后续传图规则：

- 普通内容图：默认传角色主锚图。
- 手绘插图模式且人物在大场景里变小：传角色主锚图 + 动作/表情/小比例场景扩展图 + 对应手绘插图参考图。
- 复杂动作、多姿态、多表情：传角色主锚图 + 动作/表情/小比例场景扩展图。
- 角色跑偏、返修或审核：查看角色规范说明图，必要时辅助传图，但不要把它当默认主参考。
- 知识卡模式：通常传角色主锚图；如果用户 IP 需要讲解、指向、批注、搬运卡片等动作，再加动作扩展图。

## 内容理解规则

读取：

- `references/content-workflow.md`
- 长文或多段内容：重点使用其中的 shot list 规则
- 一句话主题：使用其中的一句话扩展规则

内容输入后，先判断输入源，不要先让用户选择场景、尺寸或图内信息量。先理解内容，再推荐出图方案。

长文默认先给 shot list，不直接全量出图。文章很短可推荐 1-3 张；普通长文通常 4-8 张，最多不要轻易超过 9 张。

一句话不要直接丢给生图工具。先扩展成可确认的图解脚本，再生成内容确认卡。

## 出图方案推荐

读取 `references/modes-and-sizes.md`。

如果是 PPT 演讲模式，同时读取 `references/ppt-presentation-mode.md`。

先判断视觉模式：

- **手绘插图模式**：白底手绘图解插画，留白多，一个主隐喻或一个动作逻辑。人物常常是小比例行动角色，必须靠角色主锚图和小比例场景扩展图保持稳定。
- **知识卡模式**：完整内容容器，可承载标题、模块、步骤、风险、行动、金句、评分、截图批注、课程结构等。知识卡形态可参考样本，但不要被样本限制；根据内容结构、发布比例和阅读场景创造合适形态。用户 IP 通常是主讲人、拆解者、批注者或调度者；执行 Agent 默认穿插在方法、步骤、流程、对比、案例、风险和行动工单中，承担执行、反馈、试错、搬卡片、递交结果和标记风险。
- **PPT 演讲模式**：连续页面容器。用于有个人 IP 角色前提的直播分享、课程课件、主题演讲和案例复盘。先做整套导演规划卡，再做样张，再分批生成整页 PPT 页面图。

每次推荐必须包含：

```text
视觉模式：[手绘插图模式 / 知识卡模式]
首选：[图类型]
默认尺寸：[比例]
图内信息量：[画面更空 / 讲清楚重点 / 内容更完整 / 完整海报]
结构/形态：[路线图卡 / 白板讲解卡 / 行动工单 / 或为本内容定制的新形态]
角色分工：[用户 IP 如何参与核心动作；Agents / 执行者 / 用户等如何辅助]
辅助 Agent 分工：[哪些内容需要执行 Agent；每个 Agent 做什么动作；是否需要失败案例 / 用户反馈 / 风险提示]
出图效果：[用户能理解的结果描述]
推荐原因：[基于内容结构的判断]

还可以选：
1. [备选图类型]：[效果说明]
2. [备选图类型]：[效果说明]
```

不要把推荐锁死。用户可以改图类型、尺寸和图内信息量。

如果是 PPT 演讲模式，推荐输出改为：

```text
视觉模式：PPT 演讲模式
整套目标：[直播分享 / 课程课件 / 主题演讲 / 案例复盘]
默认尺寸：16:9
初步页数：[按内容判断]
风格方向：个人 IP 手绘演讲 PPT 风
导演规划：先输出每页页面类型、视觉权重、主视觉、图文比例、人物使用和 QA 风险
样张建议：先选 1-2 页代表页确认字体、人物和信息密度
推荐原因：[基于大纲和听众体验的判断]
```

## 内容确认卡

内容型图片出图前，必须先给内容确认卡：

```text
图类型：
尺寸：
图内信息量：
核心观点：
图内标题：
图内文字：
主画面隐喻：
角色动作：
辅助 Agent 分工：
建议元素：
必须保留的词：
可自由发挥的部分：
本图参考的角色资产：
```

Skill 的责任是先把图内文字和结构整理清楚，并在出图后检查文字准确性、可读性和信息量。

## 生图与 prompt 分流

如果当前环境有图像生成工具：

- 用户明确要“生成 / 出图 / 直接做图”时，可以直接生成。
- 调用前仍要构造完整 prompt，便于返修和复用。
- 每张图单独生成，不要把多张图拼成一张，除非用户明确要卡组总览。

如果当前环境没有图像生成工具：

- 输出可复制到常见图像生成模型的 prompt。
- 同时输出返修 prompt。

## Prompt 编写

读取 `references/prompt-templates.md`。

每个 prompt 必须包含：

- 已确认的个人 IP 角色锚点。
- 本次应引用的角色资产：角色主锚图 / 动作扩展图 / 规范说明图。
- 白底、极简手绘、留白、克制红橙蓝批注。
- 当前图类型和尺寸。
- 内容确认卡里的核心观点、图内文字、主画面隐喻、角色动作、辅助 Agent 分工。
- 手绘插图模式 / 知识卡模式：禁止太 PPT、商业海报、幼态可爱、复杂背景、复刻旧图。
- PPT 演讲模式：必须像 PPT 页面，但禁止廉价模板、培训讲义、信息图堆叠、字体混乱、人物漂移和商业海报感。

## QA 与返修

读取 `references/qa-repair.md`。

如果是 PPT 演讲模式，同时读取 `references/ppt-presentation-mode.md` 的单页 QA、整套 QA 和返修优先级。

检查顺序：

1. 角色是否像角色主锚图，是否保留识别锚点；不像主锚图直接不合格。
2. 角色是否参与核心动作，不是站旁边装饰。
3. 内容是否准确表达用户确认的观点。
4. 图内文字是否准确、可读、不过量。
5. 风格是否仍是白底手绘、留白、克制。
6. 如果是方法论 / 步骤 / 流程 / 对比 / 案例 / 风险 / 行动工单类知识卡，是否有执行 Agent 或动作隐喻；只有 IP 主角 + 文字时，判为图解感不足。
7. 手绘插图模式 / 知识卡模式是否太 PPT、太商业、太幼态、太精致；PPT 演讲模式是否不像 PPT 页面，或像廉价模板、培训讲义、信息图堆叠。
8. 是否复刻旧图构图。
9. 用户可见文字是否误写内部代称；如出现，改为 Agents、执行 Agent、用户、执行者、反馈来源等。

返修时把用户语言转成具体修改，不要重新发明整套角色，除非用户要求重做。

## 安全和授权边界

读取 `references/safety-and-assets.md`。

默认只处理用户明确授权提供的照片、主页截图、简介、账号资料和内容材料。不要鼓励用户上传他人肖像、私密截图或无授权参考图。

不要把某个用户确认后的角色资产放进公共 Skill 包作为默认资产。公共包只能放通用参考图、版式示例和文字说明。

