漫画式说明图
效果预览
把复杂内容转成清楚、轻量、有漫画感的说明图提示词;如果用户要求直接生成图片,则整理最终提示词后调用 imagegen skill 的 image_gen 工具。
顶部元信息
- 默认比例:
16:9 - 默认语言:中文
- 默认画风:白底、黑色线条、简单表情、动作清晰、少量强调色
- 默认内容策略:遵循帕累托法则,只保留最重要的 20% 信息来表达 80% 含义
- 直接出图:当用户说“生成图片”“直接出图”“帮我画”“出图”“生图”时,先整理最终提示词,再调用
image_gen - 持续对话默认:如果上一张或上一版已经使用本 skill,且用户没有明确换角色,则沿用同一组人物设定、服装、发型、线条风格和强调色
Core Workflow
Step 1:判断交付物
- 用户只要提示词:输出最终提示词。
- 用户要图片:整理最终提示词,并调用
image_gen。 - 用户给了长文本、文章、观点或流程:先压缩为视觉重点,不要原文搬运。
Step 2:用帕累托法则提炼内容
只提取最能解释主题的少量信息:
- 一个中心观点:这张图想让人记住什么。
- 两到四个关键元素:人物、对象、动作、箭头、对话气泡、标签。
- 最多一条关系路径:因果、对比、步骤、选择、误区到正解。
- 少量文字:标题 1 个,关键词 2 到 5 个,短气泡 1 到 3 个。
严禁把长段落放进画面。若用户输入很长,先转译成图像动作、简单符号和短标签。
Step 3:选择漫画结构
根据内容选择一种结构,不要混用太多:
- 单幅场景:一个人或两个人用动作解释一个概念。
- 左右对比:错误做法 vs 正确做法,或复杂状态 vs 简化状态。
- 三格分镜:问题出现、关键转折、结果呈现。
- 对话说明:两个人简短对话,用气泡呈现观点冲突或解法。
- 流程路径:人物沿着箭头移动,经过 3 个以内节点。
Visual Style
- 画面为横向
16:9,白色或极浅背景,大量留白。 - 使用黑色手绘线条,线条干净、轻松,不要厚重脏乱。
- 人物表情简单:微笑、疑惑、惊讶、认真、恍然大悟即可。
- 人物动作清晰:指向、递交、推开、连接、观察、讨论、举牌、走向目标。
- 只使用 1 到 2 种强调色,例如蓝色、黄色、红色或绿色,用于箭头、重点标签、气泡边框、小道具。
- 文字必须少、短、可读,适合中文;不要密集排版,不要长句。
- 构图应像“漫画式说明图”,不是海报、广告 KV、复杂商业插画、写实摄影或 3D 渲染。
Character Consistency
多轮对话、系列图或多张图任务中,必须显式写入人物一致性约束:
- 沿用同一人物的性别/年龄感、发型、脸型比例、服装轮廓、主色小配件和线条风格。
- 只根据新主题调整动作、姿势、道具和表情。
- 如果画面中有两个固定人物,用稳定代号描述,例如“角色 A:短发圆脸,蓝色上衣;角色 B:长发,黄色围巾”。
- 不要在同一套图里让角色突然变成不同年龄、不同服装体系或不同画风。
Prompt Writing Rules
- 先写“整体风格”,再写“主题提炼”,再写“画面构图”,最后写“文字和限制”。
- 将抽象观点翻译成动作和道具,不要只堆文字框。
- 在提示词中明确“遵循帕累托法则,仅提取重点”。
- 指定“不要出现大段文字、不要密集小字、不要复杂背景”。
- 指定“simple facial expressions, clear body actions, black line art, minimal accent colors”。
- 如果用户没有给标题,生成一个 4 到 10 字的中文短标题。
- 如果用户给了非常复杂的内容,默认输出一版最清楚的方案;只有用户要求多方案时再给 2 到 3 个方向。
Default Output Template
只要提示词时,输出这个结构:
# 漫画式说明图提示词
## 最终提示词
[可直接用于出图的完整提示词]
最终提示词可按以下骨架自然改写:
请生成一张 16:9 横向漫画式说明图,中文,白色或极浅背景,大量留白。整体风格是简洁手绘漫画说明图:黑色线条为主,人物表情简单但明确,动作清晰,使用 1 到 2 种少量强调色点出重点。画面遵循帕累托法则,只提取最重要的少量信息来解释主题,不要出现大段文字、密集小字、复杂背景或装饰性堆叠。
主题:[提炼后的主题]
核心观点:[一句话核心观点]
画面构图:
- [漫画结构:单幅场景 / 左右对比 / 三格分镜 / 对话说明 / 流程路径]
- [人物、动作、道具、箭头或气泡如何表达主题]
- [视觉重点如何落在 1 到 3 个关键元素上]
人物设定:
- [角色 A 的稳定特征]
- [角色 B 的稳定特征,如需要]
- 如果这是系列图或持续对话,沿用上一张/上一版同一人物的年龄感、发型、脸型比例、服装轮廓、主色配件和线条风格,只调整动作、姿势、道具和表情。
图中文字只保留短标题和少量关键词,可包含:
- 标题:[4 到 10 字中文标题]
- 关键词:[2 到 5 个短词]
- 对话气泡:[1 到 3 句短句,每句尽量不超过 12 个字]
限制:不要写长段落;不要把用户原文整段放进图里;不要写实摄影;不要 3D 渲染;不要复杂渐变;不要密集图表;不要让文字遮挡人物动作。图片比例 16:9。
Output Modes
只要提示词
如果用户明确要求“只要提示词”“不要出图”“给我 prompt”,只输出最终提示词。
直接出图
如果用户要求生图、画图或生成图片:
- 内部完成内容压缩和最终提示词。
- 调用
image_gen生成图片。 - 生成后保持回复简短,不输出长分析。
多方案
如果用户说“给几个方向”“来 3 个版本”,最多输出 3 个方案。若用户要求出图,再按用户选择或默认优先第 1 个方案调用 image_gen。
Do / Don't
Do
- 先压缩内容,再视觉化。
- 用动作、表情、道具和箭头承载含义。
- 让每个气泡都短而有用。
- 系列图中保持人物一致性。
- 默认 16:9。
- 生图时使用
image_gen。
Don't
- 不要把复杂文章直接塞成满屏文字。
- 不要用过多角色、过多分镜或过多颜色。
- 不要做成 PPT 信息图、写实海报、商业广告或 3D 图。
- 不要让人物只摆姿势却没有解释功能。