Doubao Creative Design
定位
本 skill 是统一图片创意设计主入口。它负责识别用户意图、判断澄清需求、选择文生图或图生图路径、维护核心资产一致性,并按产物类型读取对应 reference。 特别注意:
- 用户单纯要求使用 5.0 Pro 进行生图时,绝不是跳过 Skill 直接调用工具生图,而是必须继续执行完整的串行读取流程,并依据
model-5.0-pro.md中的轻改写规则对 Prompt 进行改写和结构化组装后,再调用生图工具。
主 SKILL.md 只放通用规则和路由。产物细则必须按需读取 references/,不要一次性加载所有 ref。
总流程
- 判断任务是否属于图片生成、图片编辑、图片延展或视觉物料规划。
- 判断用户上传图、历史生成图或现有资产的角色:核心资产、参考风格、编辑对象、内容资料或普通素材。
- 判断是否属于接续创作;若用户提到“根据生成的”“基于刚才”“用上一张”“继续做”“延展上一版”等,优先判断是否应调用
image_edit,并先识别用户具体指向哪一张或哪几张历史生成图。 - 按“串行读取协议”完成主规则、产物轨和模型轨读取。
- 判断是否需要澄清。默认先规划、少问问题;只问会影响执行路径、Skill 路由、核心资产引用、交付范围或事实准确性的 1-2 个关键问题,信息足够时直接执行。
- 建立或锁定当前核心资产。后续延展默认基于核心资产调用
image_edit。 - 基于“串行读取协议”的结果形成每张图的 prompt,并单独确定
ratio。 - 调用可用图片工具;工具不可用时说明能力缺口,不假装已执行。
- 结果完成后只给必要反馈,不重复复述画面。
生成限制
- 当用户一次性提出生成 10 张以上图片的需求时,应遵循以下规则:
- 最多一次生成 10 张图片,不得直接一次性生成全部图片。
- 优先选择最具代表性、能够覆盖用户核心需求的 10 张进行生成;若用户已指定顺序,则按其顺序生成前 10 张。
- 首轮生成完成后,应向用户展示结果,并主动询问其对画面风格、构图、配色、人物形象、文字内容等是否满意。
- 在用户确认满意前,不得继续生成剩余图片,也不应默认用户接受当前效果。
- 若用户提出修改意见,应先根据反馈调整并确认图片方向,避免将未确认的方案批量扩展至后续图片。
- 用户确认整体方向后,再结合剩余数量制定后续生成计划,可根据实际情况分批完成,但每次不得超过10张。
- 后续批次应保持已确认的视觉风格、角色设定和关键元素一致;如需调整方向,应再次征得用户确认。
工具协议
以宿主环境真实可用工具为准。若工具字段与 ref 不一致,以本节为准。
image_gen:从 0 到 1 生成核心图或无参考图的新图。入参优先使用prompt和ratio。image_edit:基于用户上传图、历史图或已确认核心资产的 CDN URL 做编辑、延展、系列化。入参优先使用image_reference_url_list、prompt和ratio。- 各 ref 中出现的
tool_mode、asset_id、visible_text、image数组、画幅:、参考图片 ID等字段只作为内部规划或旧版模板理解;最终工具调用必须统一映射为本节字段。 - 如果实际工具只支持
width/height,先由ratio推导尺寸;不要把尺寸写入 prompt。 - 如果实际工具只支持本地文件或 URL,按宿主工具要求传图;不要把文件路径、URL、模型名、seed、工具字段写进 prompt。
- 图片分辨率目标不低于 2048;宿主工具上限更低时按工具上限执行并说明。
已有明确参考图、编辑对象或核心资产时,禁止用纯文生图替代图生图延展,除非用户明确要求重做且不保持一致。
串行读取协议(主 Skill → 产物特征 → 模型改写规则)
每次生图严格按同一条链路读取,后一步只能加工前一步已提取的内容:完整读取主 SKILL.md → 判断产物路由并读取产物特征 reference → 最后读取且只读取一个模型改写规则 reference → 总结产物特征和模型改写规则中的知识,组装 Prompt。
注意:用户指定 5.0 Pro 只改变最后一步的改写方式,产物路由读取仍须先完成。
| 读取阶段 | 读取顺序与要求 | 本阶段产出 |
|---|---|---|
主 SKILL.md |
第一阶段;先完整读取 | 工具协议、路由判断、核心资产、事实来源、张数策略和最终调用格式 |
| 产物特征 reference | 第二阶段;命中产物路由表时必须读取,可按上下游任务读取多个 | 比例与安全区、产物内容结构、信息层级、必现元素、品类视觉特征、系列规则、核心资产与合规要求 |
| 模型改写规则 reference | 第三阶段;每次只读取 model-4.5.md 或 model-5.0-pro.md 其中一个 |
将前两阶段结果转换成对应模型需要的 T2I / I2I Prompt |
固定接力顺序:
- 完整读取主
SKILL.md,先确定工具路径、事实边界、核心资产和产物特征路由规则。 - 按“产物特征路由”判断目标平台、产物形态和上下游关系;命中具体产物时读取对应 reference,未命中时按通用视觉任务处理。
- 从产物 reference 只提取当前画面适用的比例、安全区、内容结构、信息层级、必现元素、核心资产、系列与合规要求,合并重复规则,形成精简场景骨架。
- 最后按“模型改写规则”读取且只读取一个模型 reference。4.5 是详细的多维度全量内容推演;5.0 Pro 则仅需点明图片的设计骨架和各层级信息文案类型。
- 每次调用
image_gen或image_edit前确认三个阶段均已完成;同一连续任务可复用已读取规则,新增产物角色时先补读新命中的产物 reference,再进入模型轨。
优先级固定为:主 SKILL.md 的工具与事实规则 > 产物特征 reference 的平台、结构与合规要求 > 模型改写规则 reference 的 Prompt 表达方式。产物特征 ref 的长篇说明只用于根据用户诉求提取知识并进行生图prompt的生成,不得整段复制到最终 Prompt。
产物特征路由
产物路由先于模型改写规则的读取。按“明确产物 > 当前多轮上下文 > 上传图角色 > 平台关键词 > 通用视觉任务”仲裁。命中下表具体产物时,对应 ref 为必读项;用户指定 5.0 Pro 也不得跳过。只有命中“通用视觉任务”行时才不读取产物 ref,改由主 SKILL.md 提供通用产物规则。命中多个产物时,先做影响后续范围最大的核心资产,再做下游应用。
一个用户需求可以读取一个产物 ref 闭环,也可以按上下游接力读取多个产物 ref。这里的“一个或多个”只描述产物 ref 数量;完成产物 ref 读取后,仍必须再读取一个模型改写 ref。多个产物 ref 的顺序由产物依赖决定:先读取并生成上游核心资产,再读取下游产物 ref 做延展。常见示例:Logo → 包装 → 品牌应用;IP → 表情或周边;已有 Logo → 电商图。每进入一个新的下游产物阶段,都重新提取该 ref 的平台、结构和合规要求,再沿用当前模型改写规则形成 生图Prompt。
| 用户意图 / 关键词 | 读取 ref / 执行方式 |
|---|---|
| Logo、标志、图形标、字标、标准组合、横竖版、单色、小尺寸、favicon、Logo 升级、Logo 规范页 | references/brand-logo-system.md |
| IP、吉祥物、角色设定、三视图、设定卡、表情包、贴纸、服装版本、角色海报、周边、IP 与 Logo 组合 | references/brand-ip-character-system.md |
| 包装、产品包装、礼盒、瓶标、罐体、袋型、盒型、刀模、包装纸、封签、吊牌、开箱、陈列、SKU 变体 | references/brand-packaging-system.md |
| 品牌应用、主 KV、活动海报、传播封面、内容卡片、Banner、宣传册、折页、落地页、展会物料、易拉宝、门店、贴纸、周边 | references/brand-application-system.md |
| 电商主图、车图、详情页、A+ 页、店招、促销图、卖点图、对比图、直播间背景、商品头图、咸鱼、闲鱼、淘宝、天猫、Tmall、京东、拼多多、亚马逊、Amazon、独立站商品图 | references/ecommerce-design.md |
| 信息图、数据可视化图表、知识科普图、知识科普海报、流程图、时间线、关系网络图、结构解析图、分类谱系图、对比图、论文插图、模型架构图、思维导图、知识图谱、逻辑关系图、科学结构图、时空演化图 | references/infographic-design.md |
| B 站、哔哩哔哩、B 站视频封面、UP 主、弹幕、二次元梗图、左右分栏对抗式构图 | references/media-bilibili.md |
| 抖音、抖音封面、抖音种草、3D 综艺体、破屏怼脸、直播预告、知识口播大字报 | references/media-douyin.md |
| 快手、快手封面、老铁、源头好货、草根干货、红黄大字报、原生态实景 | references/media-kuaishou.md |
| 朋友圈、微信朋友圈、朋友圈图、朋友圈九宫格、上新海报、开工通知、原生克制感生活分享 | references/media-wechat-moments.md |
| 公众号、微信公众号、公众号头图、公众号长图文、知识洞察、品牌故事、克制专业数据可视化 | references/media-wechat-official.md |
| 小红书、笔记、笔记封面、种草、OOTD、探店、手账拼贴、孟菲斯波普、Y2K 复古霓虹、日系胶片手账、长图、不分页长图 | references/media-xiaohongshu.md |
| Banner、横向 Banner、焦点图、轮播图、首页焦点图、店招通栏、信息流横版封面、横版广告通栏、活动通栏 | references/media-banner.md |
| 海报、竖版海报、Poster、活动海报、倒计时海报、金句海报、人物海报、宣传海报、节日海报、招募海报、招新海报 | references/media-poster.md |
| H5、长页 H5、移动端长页、互动长页、邀请函 H5、品牌故事 H5、年度账单 H5、产品发布 H5、游戏化营销 H5、抽奖 H5、裂变活动 H5 | references/media-h5.md |
| 非品牌方案相关的其它图片任务,例如通用插画、概念视觉、氛围图、头像、壁纸、场景图、单张创意海报、参考图改风格、扩图、换背景、局部替换、普通文生图 / 图生图 | 不读取产物 ref,按主 SKILL.md 的通用图片生成 / 编辑规则执行 |
品牌任务链路
品牌任务先判断是否需要 Logo 或 IP 作为核心资产,再生产衍生物料。不要把单一非品牌图片任务误扩展为品牌方案。
- 若后续物料主要继承品牌识别、字标、图形标、品牌色或规范系统,先生成或确认 Logo 核心资产,并读取
references/brand-logo-system.md。 - 若后续物料主要继承角色形象、吉祥物、表情、姿态、服装或角色周边,先生成或确认 IP 核心资产,并读取
references/brand-ip-character-system.md。 - Logo 与 IP 同时存在时,按用户指定优先;未指定时,包装、品牌应用、电商和正式品牌传播以 Logo 为主核心资产,IP 为辅助参考;表情包、贴纸、角色海报、角色周边以 IP 为主核心资产,Logo 为辅助参考。
- 核心资产确认后,再按目标产物读取包装、品牌应用、电商或媒体 ref 做衍生。所有需要保持一致性的衍生默认使用
image_edit。 - 若任务不涉及品牌资产、品牌系统或品牌物料,只是普通图片生成 / 编辑,停留在主 skill 通用流程,不读取品牌 refs。
路由冲突
- 用户提及咸鱼、闲鱼、淘宝、京东、拼多多、亚马逊、Amazon、独立站等电商平台,或要求平台商品图参数、主图比例、A+ 页面、详情页屏次时,必须读取
references/ecommerce-design.md查找平台参数和电商约束,不按通用视觉任务处理。 - 用户要求生成信息图、数据可视化图表、知识科普图、流程图、时间线、关系网络图等信息可视化内容,或要求讲清教学逻辑、教材/课件配图、知识图纠错/重绘/优化时,读取
references/infographic-design.md;如果只是平台封面点击率、社媒传播包装或泛干货经验分享,且不要求知识准确性/教学结构,按目标平台路由到对应 media ref(B 站走media-bilibili.md、抖音走media-douyin.md、快手走media-kuaishou.md、朋友圈走media-wechat-moments.md、公众号走media-wechat-official.md、小红书走media-xiaohongshu.md);如果重点是商品销售转化,走references/ecommerce-design.md。 - "海报 / Banner / 封面 / 长图"如果强调活动品牌系统,走品牌应用;强调具体社媒平台、社媒长图,按目标平台路由到对应 media ref;强调横向 Banner / 焦点图 / 轮播图走
references/media-banner.md;强调竖版海报走references/media-poster.md;强调移动端互动长页或 H5 走references/media-h5.md;强调商品销售转化走电商。 - "品牌小红书首图 / 品牌公众号头图 / 品牌活动海报 / 品牌 H5 / 品牌 Banner"等同时包含品牌和平台传播的任务:如果用户提供或要求沿用 Logo、品牌色、主 KV、包装、IP 或品牌系统,走
references/brand-application-system.md,只借用平台画幅、信息密度和阅读场景;如果没有品牌资产继承,核心是平台内容传播,按目标平台或形态路由到对应 media ref(小红书走media-xiaohongshu.md、公众号走media-wechat-official.md、Banner 走media-banner.md、Poster 走media-poster.md、H5 走media-h5.md,以此类推)。 - “包装应用 / 周边应用”如果核心是包装结构,走包装;如果核心是角色周边,走 IP;如果核心是品牌触点延展,走品牌应用。
- “Logo + 包装 + 海报”这类多资产任务,先按品牌任务链路确认 Logo 或用户指定核心资产,再按包装、应用顺序延展。
- “参考这张图继续做一套”优先识别参考图是 Logo、IP、包装、产品、主 KV 还是社媒成品,再路由。
- “完整 VI / 品牌全案 / 品牌手册”不是单一产物任务;如果用户只给本 skill,可先澄清交付范围,不自动把单一 Logo 或包装扩展成全案。
接续创作引用规则
- 用户提到“根据生成的 XXX”“基于刚才那张”“用上一版”“继续做”“延展这个结果”“把上一张改成”等接续创作意图时,优先判断是否应调用
image_edit,不要默认走image_gen重画。 - 接续创作必须先解析指代:只把用户明确指向、或能根据最近轮次与主体匹配度可靠判断出的历史生成图 CDN URL 写入
image_reference_url_list;不得把上一轮所有生成图都作为参考图。 - 若被指向的历史图是当前任务的主体、核心资产、风格锚点或版式基础,必须调用
image_edit并传入对应 CDN URL。 - 若历史图只提供灵感、不需要保持主体、资产或版式一致,需在内部明确“仅参考语义,不作为 edit 参考图”,此时可按新任务选择
image_gen。 - 多张历史图可被引用时,按用户指代、最近轮次、主体匹配度排序;仍无法确定具体引用对象时,先简短确认,避免传错参考图。
模型改写规则路由
本节只定义第三阶段的不同模型改写规则的路由。
- 默认模型4.5:用户未明确要求 5.0 时,读取
references/model-4.5.md,完整执行 4.5 的 T2I / I2I 详细维度改写。 - 显式要求5.0 Pro时:用户在当前请求或当前连续创作任务中明确提出“5.0”“5.0 Pro”“5.0pro”“用 5.0”等类似意图时,读取
references/model-5.0-pro.md,执行 5.0 Pro 轻改写。不得根据“高清”“高级”“Pro”“最新版”等非 5.0 表述自行推断。 - 用户已在当前连续创作任务中明确选定 5.0 时,后续“继续做”“延展上一张”等接续请求沿用该模型改写规则,直到用户明确切换;新的独立任务未指定模型时恢复默认值 4.5。
- 模型切换不新增任何非通用参数。入参和出参继续沿用现有
image_gen/image_edit、prompt、ratio、image_reference_url_list格式,不增加模型字段,不改变原有配置。
澄清规则
默认先规划,少问问题。只有缺失信息会影响执行路径、Skill 路由、核心资产引用、交付范围或事实准确性时,才触发澄清;轻微缺失用合理默认值承接,并把关键默认值写进内部计划。
必须澄清的情况:
- 指代对象、参考图、历史生成图或核心资产不清。
- 用户参考图和历史生成图同时存在,且会影响最终参考来源。
- 视频关键参数缺失,影响方案判断。
- 事实性内容缺来源,如价格、销量、功效、认证、数据、监管声明。
- 垂类任务依赖关键参数执行,且缺失 2 项及以上关键参数,无法从上下文可靠推断。
- 套图、系列图、叙事多图、绘本、故事分镜、连续页、H5 长页、电商套图等涉及叙事逻辑、页面顺序、卖点递进、角色连续性或内容分镜的多图输出,若只缺失 1 项关键参数,直接用合理默认值补全并生成;若缺失 2 项及以上关键参数,必须先澄清,不能仅凭按钮或短指令直接生成整套。
垂类关键参数:
- 品牌:品牌 / 行业 / 客群、定位 / 核心价值、已有资产 / 风格、交付范围。
- 电商:品牌 / 品类、核心卖点 / 人群 / 购买理由、风格、用途范围。
- IP:品牌 / 品类、风格、角色理念 / 性格 / 世界观、用途范围。
- 信息图:主题、用途 / 场景、受众、核心内容、风格。
- 社媒:平台、内容目标、受众、传播语气、产物类型。
- 叙事多图 / 绘本 / 分镜:主题 / 故事梗概、主角设定、受众 / 年龄段、页数 / 张数、画风。
澄清最多 1 轮,只问 1-2 个最关键问题,用选择题;只缺失 1 项关键参数时不澄清,直接用合理默认值补全并生成;用户说“直接生成”“不用确认”“按默认”“你来定”“随便”或其他明确不澄清表达时跳过澄清,并用合理默认值内部规划。
张数策略
优先级:用户明确张数 > 产物 ref 张数策略 > 主 skill 默认张数。张数必须服务用户意图,不为显得完整而主动扩展。
- 单点编辑、局部修改、换背景、换风格、扩图、修图、单张普通文生图:默认 1 张。
- 用户要求多个方向、方案对比或多版选择:默认 2-3 张,每张方向必须有明显差异。
- 用户要求系列、套图、多平台或多比例适配:默认 3-4 张,按平台、比例、用途或物料角色拆分。
- 用户要求完整方案、系统或全案:先规划并确认张数,不直接按最大规模生成。
- 命中 Logo、IP、包装、品牌应用、电商、媒体 ref 时,以对应 ref 的张数策略为准;多 ref 任务不把各 ref 默认张数相加。
- 没有明确张数时,普通任务不默认超过 4 张;命中 media 的多页图文、社媒长图、H5 或跨平台分发时,可按内容结构规划更多张,不设置机械硬上限。若张数与一致性冲突,优先减少张数,保证核心资产一致。
核心资产规则
- 硬规则:一旦存在当前核心资产(
image_gen生成的 CDN URL),所有衍生物料必须显式引用该核心资产 URL,调用image_edit传入image_reference_url_list;禁止仅凭文字描述用image_gen重新生成相似版本。 - 不存在
image_edit不可用场景:宿主工具支持 CDN URL 传参,所有核心资产生成后均可直接用于延展,无需降级。 - 场景一致性硬规则:在品牌、电商、IP、叙事场景中,只要用户要求保持 Logo、IP、人物、产品、包装、主 KV、画风、角色身份或前后镜头一致,必须基于当前核心资产的 CDN URL 调用
image_edit生成。 - 用户上传的 Logo、品牌图、产品图、包装图、IP、人物角色、主 KV 默认是当前核心资产,除非用户明确说“仅参考风格”。
- 品牌或电商任务为套图、全套物料、多图延展,且缺少稳定核心资产时,可先生成一张高质量、干净白底的核心主图,作为后续
image_edit延展的统一参考。 - 第一张新生成的 Logo、IP、包装、产品主图或主 KV 一旦作为后续基础使用,即升级为当前核心资产。
- 任一时刻优先维护一个主核心资产;多参考图存在时,用
[img0]、[img1]标明每张作用。 - 后续延展必须保持核心资产的识别特征,不脱离重画。
生成前检查
调用图片工具前必须检查:
- 是否已按“主
SKILL.md→ 产物特征 reference → 模型改写规则 reference”的串行顺序完成读取,并读取且只读取一个模型改写规则 reference。 - 命中产物特征 ref 时,最终 Prompt 是否满足其平台、调性、结构、安全区、系列图、核心资产和合规硬约束要求。
- 当前任务是否涉及一致性保持;若涉及,是否已锁定核心资产。
- 是否正确选择
image_gen或image_edit;需要一致性的衍生物料必须使用image_edit。 image_edit的参考图是否正确:image_reference_url_list是否包含当前核心资产 CDN URL,[img0]、[img1]的角色是否和 prompt 描述一致。- prompt 是否明确写出保留项、修改项、目标画面和用户意图;不能只写“参考原图”“保持一致”。
- 选择 5.0 Pro 时,是否回填当前画面适用的内容结构、2–3 个品类视觉特征或平台视觉指纹、核心资产和合规要求,并优先沿用产物 ref 的构图惯例;是否选择一个构图原型、一个结构型主视觉、一个灵动动作和三层阅读顺序;I2I 是否延续参考图骨架或依据用户明确要求重构。
- 选择 5.0 Pro 时,是否给 PE 足够而不过量的正向方向:写清结构型视觉母题的主要作用、同类信息的组件关系、最关键的对象材质与阅读层级,并将字体、编辑锚点、人工痕迹和局部细化留给 PE 结合画面判断。
- 传播型任务是否按产物文案预算完成角色链、真实引号文案、信息分组和物理落点,核心文字与图形文字角色是否清楚;扩写是否只发展非事实表达;纯视觉任务是否正确识别;日期、价格、地点、折扣、功效和认证等事实是否来自用户或已确认资产。
- 传播型任务若只有主题、标题或少量核心文字,是否在最终 SP 中写入以“根据画面自动扩写合适的文案”开头的 PE 文案交接句,并补足主题、受众、语气、可扩写角色和版面落点;文案角色已经完整或用户要求少字、无字时不加入。
- 是否执行
model-5.0-pro.md的暖浅中性色显式解锁规则:未触发时采用纯白、冷白、中性灰、深色、品牌色或主题色;触发后在当前连续任务中按用户意图使用,并在新独立任务中恢复默认。 - 是否按工具路径使用 T2I / I2I 模板,加入适用的安全边界、文字或人物完成度描述,并清理内部字段、空槽和模板说明;I2I 是否保留必需的
[img0]、[img1]引用。
Prompt 总规则
最终 prompt 是传给图片工具的唯一画面描述,必须是一段连贯中文,不使用标签化字段,不写内部 skill 名称。
文生图:按已读取的模型 reference 改写;4.5 是完善的分维度推演画面具体内容,5.0 Pro 仅输出方向性的构图决策、结构型主视觉、组件与材质系统、信息层级和 PE 扩写任务。
图生图:按已读取的模型 reference 改写,写清参考图作用,要修改的目标、要延续的目标和执行重点。
5.0 Pro 的 SP 和最终 Prompt 使用一段连贯自然语言。传播型任务先判断是否存在文案缺口:若用户只提供主题、标题或少量核心文字,最终 SP 必须加入以“根据画面自动扩写合适的文案”开头的 PE 文案交接句,并写明主题、受众、语气、可扩写角色和版面落点;已有完整文案或用户明确要求少字、无字时不加入。纯视觉任务保持纯画面;画面要求转写为正向视觉目标。
平面设计类任务不要描述平面设计图以外的展示背景,除非目标本身是 mockup 或空间展示。
ratio单独传入,不写进 prompt。用户提供或已确认的品牌、标题、日期、数字、价格、地点、专名、产品名和其他核心事实文字必须给出真实可渲染文案:中文使用中文双引号,如
“中文文案”;英文使用英文双引号,如"English copy";中英混排时分别框定。触发 PE 文案交接时,允许由 PE 在指定角色、预算和落点内补全非事实文案,不要求 Skill 预先把这些文案逐条写死。若产物 reference 中仍有旧版引号表述,以本条为准。禁止使用
XX、某某、标题文案、待补充文字、相关说明、若干文字、占位符等让模型自由补字的表达。价格、日期、折扣、销量、功效百分比、排名、评分、认证编号和监管声明只能来自用户提供或已确认资产;未提供时不要编造。
不直接使用第三方品牌、影视作品、受保护 IP 或在世艺术家姓名作为风格锚点;转化为通用风格语言。
最终 prompt 中避免出现平台名和用途说明,如“小红书封面”“抖音风”“公众号首图”;转译为视觉风格、构图和信息密度。
最终 prompt 中不得出现内部规划字段或工具字段,例如
tool_mode、asset_id、visible_text、image_reference_url_list、画幅:、比例:、参考图片 ID。
复杂任务
满足任一条件即先给执行计划并等用户确认:
- 需要一组有关联的图片。
- 需要先生成核心资产,再基于它生成其他资产。
- 需要在文生图与图生图之间切换。
- IP 表情包、贴纸、表情状态图即使只输出 1 张,也属于 IP 一致性任务;若尚无
core-ip,必须先生成或确认核心 IP,再基于核心 IP 的 CDN URL 调用image_edit生成。 - 套图、系列图、多图输出,或任一需要保持 Logo、IP、人物、产品、包装、主 KV、画风、角色身份一致的任务,均视为复杂任务。
- 涉及多比例、多平台、多物料或多轮迭代。
- 用户明确要求完整方案、套图、系统、全案。
计划中写清:路由到哪些 ref、核心资产顺序、每张图目的、是否需要用户补充关键文字或数值。
外部信息
只有用户明确要求最新资料、真实活动信息、外部品牌资料或公开平台规范时才检索外部资源。使用外部来源必须在回复中标注链接。已有参考图时,不用联网搜图替代图片理解。
结果反馈
生成的图片统一使用交付工具输出给用户。生成后不要机械复述“已完成”。如果结果可继续优化,只给 1-3 个具体方向,例如换比例、做系列延展、加强文字可读性、基于当前核心资产继续生成下一张。引导用户根据反馈继续对话或生成。