# Doubao Creative Design

> 当用户要求从零生成、设计商业/社交媒体创意图片，或做系列延展、多比例适配时使用；触发任务包括做图、出图、生成图片、设计海报、主视觉/KV、Banner、封面、社媒配图、社媒长图、电商主图、详情页、产品图、Logo、IP角色、吉祥物、包装、品牌应用物料、活动物料、宣传册、落地页、知识科普海报、信息图、教学图、教材插图、课件配图、思维导图、知识图谱、流程图、数据图表、科学结构图、公式推导图、工程图纸、多资产视觉系统等图片设计场景。

- Skill: `ahang1598/doubao-creative-design` (Agent Skill, multi-file: 18 files)
- Install (CLI): `npx skillmds add ahang1598/doubao-creative-design`
- Raw SKILL.md: https://api.skillmd.com/api/skills/ahang1598/doubao-creative-design/raw
- Safety review: pending (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Design & Media
- Author: ahang1598 (https://skillmd.com/u/ahang1598)
- Updated: 2026-08-19
- Page: https://skillmd.com/skills/ahang1598/doubao-creative-design

---


# Doubao Creative Design

## 定位

本 skill 是统一图片创意设计主入口。它负责识别用户意图、判断澄清需求、选择文生图或图生图路径、维护核心资产一致性，并按产物类型读取对应 reference。
**特别注意**：
- 用户单纯要求使用 5.0 Pro 进行生图时，绝不是跳过 Skill 直接调用工具生图，而是必须继续执行完整的串行读取流程，并依据 `model-5.0-pro.md` 中的轻改写规则对 Prompt 进行改写和结构化组装后，再调用生图工具。

主 `SKILL.md` 只放通用规则和路由。产物细则必须按需读取 `references/`，不要一次性加载所有 ref。

## 总流程

1. 判断任务是否属于图片生成、图片编辑、图片延展或视觉物料规划。
2. 判断用户上传图、历史生成图或现有资产的角色：核心资产、参考风格、编辑对象、内容资料或普通素材。
3. 判断是否属于接续创作；若用户提到“根据生成的”“基于刚才”“用上一张”“继续做”“延展上一版”等，优先判断是否应调用 `image_edit`，并先识别用户具体指向哪一张或哪几张历史生成图。
4. 按“串行读取协议”完成主规则、产物轨和模型轨读取。
5. 判断是否需要澄清。默认先规划、少问问题；只问会影响执行路径、Skill 路由、核心资产引用、交付范围或事实准确性的 1-2 个关键问题，信息足够时直接执行。
6. 建立或锁定当前核心资产。后续延展默认基于核心资产调用 `image_edit`。
7. 基于“串行读取协议”的结果形成每张图的 prompt，并单独确定 `ratio`。
8. 调用可用图片工具；工具不可用时说明能力缺口，不假装已执行。
9. 结果完成后只给必要反馈，不重复复述画面。

## 生成限制
1. 当用户一次性提出生成 10 张以上图片的需求时，应遵循以下规则：
2. 最多一次生成 10 张图片，不得直接一次性生成全部图片。
3. 优先选择最具代表性、能够覆盖用户核心需求的 10 张进行生成；若用户已指定顺序，则按其顺序生成前 10 张。
4. 首轮生成完成后，应向用户展示结果，并主动询问其对画面风格、构图、配色、人物形象、文字内容等是否满意。
5. 在用户确认满意前，不得继续生成剩余图片，也不应默认用户接受当前效果。
6. 若用户提出修改意见，应先根据反馈调整并确认图片方向，避免将未确认的方案批量扩展至后续图片。
7. 用户确认整体方向后，再结合剩余数量制定后续生成计划，可根据实际情况分批完成，但每次不得超过10张。
8. 后续批次应保持已确认的视觉风格、角色设定和关键元素一致；如需调整方向，应再次征得用户确认。


## 工具协议

以宿主环境真实可用工具为准。若工具字段与 ref 不一致，以本节为准。

- `image_gen`：从 0 到 1 生成核心图或无参考图的新图。入参优先使用 `prompt` 和 `ratio`。
- `image_edit`：基于用户上传图、历史图或已确认核心资产的 CDN URL 做编辑、延展、系列化。入参优先使用 `image_reference_url_list`、`prompt` 和 `ratio`。
- 各 ref 中出现的 `tool_mode`、`asset_id`、`visible_text`、`image` 数组、`画幅：`、`参考图片 ID` 等字段只作为内部规划或旧版模板理解；最终工具调用必须统一映射为本节字段。
- 如果实际工具只支持 `width/height`，先由 `ratio` 推导尺寸；不要把尺寸写入 prompt。
- 如果实际工具只支持本地文件或 URL，按宿主工具要求传图；不要把文件路径、URL、模型名、seed、工具字段写进 prompt。
- 图片分辨率目标不低于 2048；宿主工具上限更低时按工具上限执行并说明。

已有明确参考图、编辑对象或核心资产时，禁止用纯文生图替代图生图延展，除非用户明确要求重做且不保持一致。

## 串行读取协议（主 Skill → 产物特征 → 模型改写规则）

每次生图严格按同一条链路读取，后一步只能加工前一步已提取的内容：**完整读取主 `SKILL.md` → 判断产物路由并读取产物特征 reference → 最后读取且只读取一个模型改写规则 reference → 总结产物特征和模型改写规则中的知识，组装 Prompt**。
**注意**：用户指定 5.0 Pro 只改变最后一步的改写方式，产物路由读取仍须先完成。

| 读取阶段 | 读取顺序与要求 | 本阶段产出 |
|---|---|---|
| 主 `SKILL.md` | 第一阶段；先完整读取 | 工具协议、路由判断、核心资产、事实来源、张数策略和最终调用格式 |
| 产物特征 reference | 第二阶段；命中产物路由表时必须读取，可按上下游任务读取多个 | 比例与安全区、产物内容结构、信息层级、必现元素、品类视觉特征、系列规则、核心资产与合规要求 |    
| 模型改写规则 reference | 第三阶段；每次只读取 `model-4.5.md` 或 `model-5.0-pro.md` 其中一个 | 将前两阶段结果转换成对应模型需要的 T2I / I2I Prompt |

固定接力顺序：

1. 完整读取主 `SKILL.md`，先确定工具路径、事实边界、核心资产和产物特征路由规则。
2. 按“产物特征路由”判断目标平台、产物形态和上下游关系；命中具体产物时读取对应 reference，未命中时按通用视觉任务处理。
3. 从产物 reference 只提取当前画面适用的比例、安全区、内容结构、信息层级、必现元素、核心资产、系列与合规要求，合并重复规则，形成精简场景骨架。
4. 最后按“模型改写规则”读取且只读取一个模型 reference。4.5 是详细的多维度全量内容推演；5.0 Pro 则仅需点明图片的设计骨架和各层级信息文案类型。
5. 每次调用 `image_gen` 或 `image_edit` 前确认三个阶段均已完成；同一连续任务可复用已读取规则，新增产物角色时先补读新命中的产物 reference，再进入模型轨。

优先级固定为：主 `SKILL.md` 的工具与事实规则 > 产物特征 reference 的平台、结构与合规要求 > 模型改写规则 reference 的 Prompt 表达方式。产物特征 ref 的长篇说明只用于根据用户诉求提取知识并进行生图prompt的生成，不得整段复制到最终 Prompt。

## 产物特征路由

产物路由先于模型改写规则的读取。按“明确产物 > 当前多轮上下文 > 上传图角色 > 平台关键词 > 通用视觉任务”仲裁。命中下表具体产物时，对应 ref 为必读项；用户指定 5.0 Pro 也不得跳过。只有命中“通用视觉任务”行时才不读取产物 ref，改由主 `SKILL.md` 提供通用产物规则。命中多个产物时，先做影响后续范围最大的核心资产，再做下游应用。

一个用户需求可以读取一个产物 ref 闭环，也可以按上下游接力读取多个产物 ref。这里的“一个或多个”只描述产物 ref 数量；完成产物 ref 读取后，仍必须再读取一个模型改写 ref。多个产物 ref 的顺序由产物依赖决定：先读取并生成上游核心资产，再读取下游产物 ref 做延展。常见示例：Logo → 包装 → 品牌应用；IP → 表情或周边；已有 Logo → 电商图。每进入一个新的下游产物阶段，都重新提取该 ref 的平台、结构和合规要求，再沿用当前模型改写规则形成 生图Prompt。

| 用户意图 / 关键词 | 读取 ref / 执行方式 |
|---|---|
| Logo、标志、图形标、字标、标准组合、横竖版、单色、小尺寸、favicon、Logo 升级、Logo 规范页 | `references/brand-logo-system.md` |
| IP、吉祥物、角色设定、三视图、设定卡、表情包、贴纸、服装版本、角色海报、周边、IP 与 Logo 组合 | `references/brand-ip-character-system.md` |
| 包装、产品包装、礼盒、瓶标、罐体、袋型、盒型、刀模、包装纸、封签、吊牌、开箱、陈列、SKU 变体 | `references/brand-packaging-system.md` |
| 品牌应用、主 KV、活动海报、传播封面、内容卡片、Banner、宣传册、折页、落地页、展会物料、易拉宝、门店、贴纸、周边 | `references/brand-application-system.md` |
| 电商主图、车图、详情页、A+ 页、店招、促销图、卖点图、对比图、直播间背景、商品头图、咸鱼、闲鱼、淘宝、天猫、Tmall、京东、拼多多、亚马逊、Amazon、独立站商品图 | `references/ecommerce-design.md` |
| 信息图、数据可视化图表、知识科普图、知识科普海报、流程图、时间线、关系网络图、结构解析图、分类谱系图、对比图、论文插图、模型架构图、思维导图、知识图谱、逻辑关系图、科学结构图、时空演化图 | `references/infographic-design.md` |
| 知识图、教育图、教学图、教材插图、课件配图、课件图优化、工程图纸、公式推导图、受力分析图、电路图、票据教学图、凭证教学图、UI教学说明图、知识图优化、知识图纠错、知识图重绘 | `references/knowledge-education-visual.md` |
| B 站、哔哩哔哩、B 站视频封面、UP 主、弹幕、二次元梗图、左右分栏对抗式构图 | `references/media-bilibili.md` |
| 抖音、抖音封面、抖音种草、3D 综艺体、破屏怼脸、直播预告、知识口播大字报 | `references/media-douyin.md` |
| 快手、快手封面、老铁、源头好货、草根干货、红黄大字报、原生态实景 | `references/media-kuaishou.md` |
| 朋友圈、微信朋友圈、朋友圈图、朋友圈九宫格、上新海报、开工通知、原生克制感生活分享 | `references/media-wechat-moments.md` |
| 公众号、微信公众号、公众号头图、公众号长图文、知识洞察、品牌故事、克制专业数据可视化 | `references/media-wechat-official.md` |
| 小红书、笔记、笔记封面、种草、OOTD、探店、手账拼贴、孟菲斯波普、Y2K 复古霓虹、日系胶片手账、长图、不分页长图 | `references/media-xiaohongshu.md` |
| Banner、横向 Banner、焦点图、轮播图、首页焦点图、店招通栏、信息流横版封面、横版广告通栏、活动通栏 | `references/media-banner.md` |
| 海报、竖版海报、Poster、活动海报、倒计时海报、金句海报、人物海报、宣传海报、节日海报、招募海报、招新海报 | `references/media-poster.md` |
| H5、长页 H5、移动端长页、互动长页、邀请函 H5、品牌故事 H5、年度账单 H5、产品发布 H5、游戏化营销 H5、抽奖 H5、裂变活动 H5 | `references/media-h5.md` |
| 非品牌方案相关的其它图片任务，例如通用插画、概念视觉、氛围图、头像、壁纸、场景图、单张创意海报、参考图改风格、扩图、换背景、局部替换、普通文生图 / 图生图 | 不读取产物 ref，按主 `SKILL.md` 的通用图片生成 / 编辑规则执行 |

### 品牌任务链路

品牌任务先判断是否需要 Logo 或 IP 作为核心资产，再生产衍生物料。不要把单一非品牌图片任务误扩展为品牌方案。

1. 若后续物料主要继承品牌识别、字标、图形标、品牌色或规范系统，先生成或确认 Logo 核心资产，并读取 `references/brand-logo-system.md`。
2. 若后续物料主要继承角色形象、吉祥物、表情、姿态、服装或角色周边，先生成或确认 IP 核心资产，并读取 `references/brand-ip-character-system.md`。
3. Logo 与 IP 同时存在时，按用户指定优先；未指定时，包装、品牌应用、电商和正式品牌传播以 Logo 为主核心资产，IP 为辅助参考；表情包、贴纸、角色海报、角色周边以 IP 为主核心资产，Logo 为辅助参考。
4. 核心资产确认后，再按目标产物读取包装、品牌应用、电商或媒体 ref 做衍生。所有需要保持一致性的衍生默认使用 `image_edit`。
5. 若任务不涉及品牌资产、品牌系统或品牌物料，只是普通图片生成 / 编辑，停留在主 skill 通用流程，不读取品牌 refs。

### 路由冲突

- 用户提及咸鱼、闲鱼、淘宝、京东、拼多多、亚马逊、Amazon、独立站等电商平台，或要求平台商品图参数、主图比例、A+ 页面、详情页屏次时，必须读取 `references/ecommerce-design.md` 查找平台参数和电商约束，不按通用视觉任务处理。
- 用户要求生成信息图、数据可视化图表、知识科普图、流程图、时间线、关系网络图等信息可视化内容，或要求讲清教学逻辑、教材/课件配图、知识图纠错/重绘/优化时，读取 `references/infographic-design.md`；如果只是平台封面点击率、社媒传播包装或泛干货经验分享，且不要求知识准确性/教学结构，按目标平台路由到对应 media ref（B 站走 `media-bilibili.md`、抖音走 `media-douyin.md`、快手走 `media-kuaishou.md`、朋友圈走 `media-wechat-moments.md`、公众号走 `media-wechat-official.md`、小红书走 `media-xiaohongshu.md`）；如果重点是商品销售转化，走 `references/ecommerce-design.md`。
- "海报 / Banner / 封面 / 长图"如果强调活动品牌系统，走品牌应用；强调具体社媒平台、社媒长图，按目标平台路由到对应 media ref；强调横向 Banner / 焦点图 / 轮播图走 `references/media-banner.md`；强调竖版海报走 `references/media-poster.md`；强调移动端互动长页或 H5 走 `references/media-h5.md`；强调商品销售转化走电商。
- "品牌小红书首图 / 品牌公众号头图 / 品牌活动海报 / 品牌 H5 / 品牌 Banner"等同时包含品牌和平台传播的任务：如果用户提供或要求沿用 Logo、品牌色、主 KV、包装、IP 或品牌系统，走 `references/brand-application-system.md`，只借用平台画幅、信息密度和阅读场景；如果没有品牌资产继承，核心是平台内容传播，按目标平台或形态路由到对应 media ref（小红书走 `media-xiaohongshu.md`、公众号走 `media-wechat-official.md`、Banner 走 `media-banner.md`、Poster 走 `media-poster.md`、H5 走 `media-h5.md`，以此类推）。
- “包装应用 / 周边应用”如果核心是包装结构，走包装；如果核心是角色周边，走 IP；如果核心是品牌触点延展，走品牌应用。
- “Logo + 包装 + 海报”这类多资产任务，先按品牌任务链路确认 Logo 或用户指定核心资产，再按包装、应用顺序延展。
- “参考这张图继续做一套”优先识别参考图是 Logo、IP、包装、产品、主 KV 还是社媒成品，再路由。
- “完整 VI / 品牌全案 / 品牌手册”不是单一产物任务；如果用户只给本 skill，可先澄清交付范围，不自动把单一 Logo 或包装扩展成全案。

### 接续创作引用规则

- 用户提到“根据生成的 XXX”“基于刚才那张”“用上一版”“继续做”“延展这个结果”“把上一张改成”等接续创作意图时，优先判断是否应调用 `image_edit`，不要默认走 `image_gen` 重画。
- 接续创作必须先解析指代：只把用户明确指向、或能根据最近轮次与主体匹配度可靠判断出的历史生成图 CDN URL 写入 `image_reference_url_list`；不得把上一轮所有生成图都作为参考图。
- 若被指向的历史图是当前任务的主体、核心资产、风格锚点或版式基础，必须调用 `image_edit` 并传入对应 CDN URL。
- 若历史图只提供灵感、不需要保持主体、资产或版式一致，需在内部明确“仅参考语义，不作为 edit 参考图”，此时可按新任务选择 `image_gen`。
- 多张历史图可被引用时，按用户指代、最近轮次、主体匹配度排序；仍无法确定具体引用对象时，先简短确认，避免传错参考图。

## 模型改写规则路由

本节只定义第三阶段的不同模型改写规则的路由。

- **默认模型4.5**：用户未明确要求 5.0 时，读取 `references/model-4.5.md`，完整执行 4.5 的 T2I / I2I 详细维度改写。
- **显式要求5.0 Pro时**：用户在当前请求或当前连续创作任务中明确提出“5.0”“5.0 Pro”“5.0pro”“用 5.0”等类似意图时，读取 `references/model-5.0-pro.md`，执行 5.0 Pro 轻改写。不得根据“高清”“高级”“Pro”“最新版”等非 5.0 表述自行推断。
- 用户已在当前连续创作任务中明确选定 5.0 时，后续“继续做”“延展上一张”等接续请求沿用该模型改写规则，直到用户明确切换；新的独立任务未指定模型时恢复默认值 4.5。
- 模型切换不新增任何非通用参数。入参和出参继续沿用现有 `image_gen` / `image_edit`、`prompt`、`ratio`、`image_reference_url_list` 格式，不增加模型字段，不改变原有配置。

## 澄清规则

默认先规划，少问问题。只有缺失信息会影响执行路径、Skill 路由、核心资产引用、交付范围或事实准确性时，才触发澄清；轻微缺失用合理默认值承接，并把关键默认值写进内部计划。

必须澄清的情况：

- 指代对象、参考图、历史生成图或核心资产不清。
- 用户参考图和历史生成图同时存在，且会影响最终参考来源。
- 视频关键参数缺失，影响方案判断。
- 事实性内容缺来源，如价格、销量、功效、认证、数据、监管声明。
- 垂类任务依赖关键参数执行，且缺失 2 项及以上关键参数，无法从上下文可靠推断。
- 套图、系列图、叙事多图、绘本、故事分镜、连续页、H5 长页、电商套图等涉及叙事逻辑、页面顺序、卖点递进、角色连续性或内容分镜的多图输出，若只缺失 1 项关键参数，直接用合理默认值补全并生成；若缺失 2 项及以上关键参数，必须先澄清，不能仅凭按钮或短指令直接生成整套。

垂类关键参数：

- 品牌：品牌 / 行业 / 客群、定位 / 核心价值、已有资产 / 风格、交付范围。
- 电商：品牌 / 品类、核心卖点 / 人群 / 购买理由、风格、用途范围。
- IP：品牌 / 品类、风格、角色理念 / 性格 / 世界观、用途范围。
- 信息图：主题、用途 / 场景、受众、核心内容、风格。
- 社媒：平台、内容目标、受众、传播语气、产物类型。
- 叙事多图 / 绘本 / 分镜：主题 / 故事梗概、主角设定、受众 / 年龄段、页数 / 张数、画风。

澄清最多 1 轮，只问 1-2 个最关键问题，用选择题；只缺失 1 项关键参数时不澄清，直接用合理默认值补全并生成；用户说“直接生成”“不用确认”“按默认”“你来定”“随便”或其他明确不澄清表达时跳过澄清，并用合理默认值内部规划。

## 张数策略

优先级：用户明确张数 > 产物 ref 张数策略 > 主 skill 默认张数。张数必须服务用户意图，不为显得完整而主动扩展。

- 单点编辑、局部修改、换背景、换风格、扩图、修图、单张普通文生图：默认 1 张。
- 用户要求多个方向、方案对比或多版选择：默认 2-3 张，每张方向必须有明显差异。
- 用户要求系列、套图、多平台或多比例适配：默认 3-4 张，按平台、比例、用途或物料角色拆分。
- 用户要求完整方案、系统或全案：先规划并确认张数，不直接按最大规模生成。
- 命中 Logo、IP、包装、品牌应用、电商、媒体 ref 时，以对应 ref 的张数策略为准；多 ref 任务不把各 ref 默认张数相加。
- 没有明确张数时，普通任务不默认超过 4 张；命中 media 的多页图文、社媒长图、H5 或跨平台分发时，可按内容结构规划更多张，不设置机械硬上限。若张数与一致性冲突，优先减少张数，保证核心资产一致。

## 核心资产规则

- 硬规则：一旦存在当前核心资产（`image_gen` 生成的 CDN URL），所有衍生物料必须显式引用该核心资产 URL，调用 `image_edit` 传入 `image_reference_url_list`；禁止仅凭文字描述用 `image_gen` 重新生成相似版本。
- 不存在 `image_edit` 不可用场景：宿主工具支持 CDN URL 传参，所有核心资产生成后均可直接用于延展，无需降级。
- 场景一致性硬规则：在品牌、电商、IP、叙事场景中，只要用户要求保持 Logo、IP、人物、产品、包装、主 KV、画风、角色身份或前后镜头一致，必须基于当前核心资产的 CDN URL 调用 `image_edit` 生成。
- 用户上传的 Logo、品牌图、产品图、包装图、IP、人物角色、主 KV 默认是当前核心资产，除非用户明确说“仅参考风格”。
- 品牌或电商任务为套图、全套物料、多图延展，且缺少稳定核心资产时，可先生成一张高质量、干净白底的核心主图，作为后续 `image_edit` 延展的统一参考。
- 第一张新生成的 Logo、IP、包装、产品主图或主 KV 一旦作为后续基础使用，即升级为当前核心资产。
- 任一时刻优先维护一个主核心资产；多参考图存在时，用 `[img0]`、`[img1]` 标明每张作用。
- 后续延展必须保持核心资产的识别特征，不脱离重画。

## 生成前检查

调用图片工具前必须检查：

1. 是否已按“主 `SKILL.md` → 产物特征 reference → 模型改写规则 reference”的串行顺序完成读取，并读取且只读取一个模型改写规则 reference。
2. 命中产物特征 ref 时，最终 Prompt 是否满足其平台、调性、结构、安全区、系列图、核心资产和合规硬约束要求。
3. 当前任务是否涉及一致性保持；若涉及，是否已锁定核心资产。
4. 是否正确选择 `image_gen` 或 `image_edit`；需要一致性的衍生物料必须使用 `image_edit`。
5. `image_edit` 的参考图是否正确：`image_reference_url_list` 是否包含当前核心资产 CDN URL，`[img0]`、`[img1]` 的角色是否和 prompt 描述一致。
6. prompt 是否明确写出保留项、修改项、目标画面和用户意图；不能只写“参考原图”“保持一致”。
7. 选择 5.0 Pro 时，是否回填当前画面适用的内容结构、2–3 个品类视觉特征或平台视觉指纹、核心资产和合规要求，并优先沿用产物 ref 的构图惯例；是否选择一个构图原型、一个结构型主视觉、一个灵动动作和三层阅读顺序；I2I 是否延续参考图骨架或依据用户明确要求重构。
8. 选择 5.0 Pro 时，是否给 PE 足够而不过量的正向方向：写清结构型视觉母题的主要作用、同类信息的组件关系、最关键的对象材质与阅读层级，并将字体、编辑锚点、人工痕迹和局部细化留给 PE 结合画面判断。
9. 传播型任务是否按产物文案预算完成角色链、真实引号文案、信息分组和物理落点，核心文字与图形文字角色是否清楚；扩写是否只发展非事实表达；纯视觉任务是否正确识别；日期、价格、地点、折扣、功效和认证等事实是否来自用户或已确认资产。
10. 传播型任务若只有主题、标题或少量核心文字，是否在最终 SP 中写入以“根据画面自动扩写合适的文案”开头的 PE 文案交接句，并补足主题、受众、语气、可扩写角色和版面落点；文案角色已经完整或用户要求少字、无字时不加入。
11. 是否执行 `model-5.0-pro.md` 的暖浅中性色显式解锁规则：未触发时采用纯白、冷白、中性灰、深色、品牌色或主题色；触发后在当前连续任务中按用户意图使用，并在新独立任务中恢复默认。
12. 是否按工具路径使用 T2I / I2I 模板，加入适用的安全边界、文字或人物完成度描述，并清理内部字段、空槽和模板说明；I2I 是否保留必需的 `[img0]`、`[img1]` 引用。

## Prompt 总规则

最终 prompt 是传给图片工具的唯一画面描述，必须是一段连贯中文，不使用标签化字段，不写内部 skill 名称。

- 文生图：按已读取的模型 reference 改写；4.5 是完善的分维度推演画面具体内容，5.0 Pro 仅输出方向性的构图决策、结构型主视觉、组件与材质系统、信息层级和 PE 扩写任务。
- 图生图：按已读取的模型 reference 改写，写清参考图作用，要修改的目标、要延续的目标和执行重点。

- 5.0 Pro 的 SP 和最终 Prompt 使用一段连贯自然语言。传播型任务先判断是否存在文案缺口：若用户只提供主题、标题或少量核心文字，最终 SP 必须加入以“根据画面自动扩写合适的文案”开头的 PE 文案交接句，并写明主题、受众、语气、可扩写角色和版面落点；已有完整文案或用户明确要求少字、无字时不加入。纯视觉任务保持纯画面；画面要求转写为正向视觉目标。

- 平面设计类任务不要描述平面设计图以外的展示背景，除非目标本身是 mockup 或空间展示。

- `ratio` 单独传入，不写进 prompt。
- 用户提供或已确认的品牌、标题、日期、数字、价格、地点、专名、产品名和其他核心事实文字必须给出真实可渲染文案：中文使用中文双引号，如 `“中文文案”`；英文使用英文双引号，如 `"English copy"`；中英混排时分别框定。触发 PE 文案交接时，允许由 PE 在指定角色、预算和落点内补全非事实文案，不要求 Skill 预先把这些文案逐条写死。若产物 reference 中仍有旧版引号表述，以本条为准。
- 禁止使用 `XX`、`某某`、`标题文案`、`待补充文字`、`相关说明`、`若干文字`、`占位符` 等让模型自由补字的表达。
- 价格、日期、折扣、销量、功效百分比、排名、评分、认证编号和监管声明只能来自用户提供或已确认资产；未提供时不要编造。
- 不直接使用第三方品牌、影视作品、受保护 IP 或在世艺术家姓名作为风格锚点；转化为通用风格语言。
- 最终 prompt 中避免出现平台名和用途说明，如“小红书封面”“抖音风”“公众号首图”；转译为视觉风格、构图和信息密度。
- 最终 prompt 中不得出现内部规划字段或工具字段，例如 `tool_mode`、`asset_id`、`visible_text`、`image_reference_url_list`、`画幅：`、`比例：`、`参考图片 ID`。

## 复杂任务

满足任一条件即先给执行计划并等用户确认：

- 需要一组有关联的图片。
- 需要先生成核心资产，再基于它生成其他资产。
- 需要在文生图与图生图之间切换。
- IP 表情包、贴纸、表情状态图即使只输出 1 张，也属于 IP 一致性任务；若尚无 `core-ip`，必须先生成或确认核心 IP，再基于核心 IP 的 CDN URL 调用 `image_edit` 生成。
- 套图、系列图、多图输出，或任一需要保持 Logo、IP、人物、产品、包装、主 KV、画风、角色身份一致的任务，均视为复杂任务。
- 涉及多比例、多平台、多物料或多轮迭代。
- 用户明确要求完整方案、套图、系统、全案。

计划中写清：路由到哪些 ref、核心资产顺序、每张图目的、是否需要用户补充关键文字或数值。

## 外部信息

只有用户明确要求最新资料、真实活动信息、外部品牌资料或公开平台规范时才检索外部资源。使用外部来源必须在回复中标注链接。已有参考图时，不用联网搜图替代图片理解。

## 结果反馈

生成的图片统一使用 `notifyhuman` 工具输出给用户。生成后不要机械复述“已完成”。如果结果可继续优化，只给 1-3 个具体方向，例如换比例、做系列延展、加强文字可读性、基于当前核心资产继续生成下一张。引导用户根据反馈继续对话或生成。

