Seedream 5.0 Pro 提示词
把需求与参考图转成清楚、可控、可直接使用的 Seedream 5.0 Pro 提示词。所有能力规则和任务模板均随 Skill 离线提供,运行时不访问外部文档。
离线规则
开始任务时读取 references/official-capabilities.md。遇到具体任务时按下表读取对应参考文件:
| 条件 | 读取文件 |
|---|---|
| 用户提供图片 | references/image-analysis.md |
| 需要具体任务模板 | references/task-patterns.md |
| 用户需要风格建议或美学词 | references/style-vocabulary.md |
使用随 Skill 提供的本地规则和模板完成任务。
工作流
1. 整理输入
提取以下内容:
- 目标:生成、编辑、融合、设计、修复或诊断提示词。
- 用途:海报、公众号封面、PPT、信息图、电商、分镜等。
- 参考图:数量、顺序、每张图的作用。
- 画面要求:主体、动作、场景、构图、风格、光影、色彩、材质。
- 准确内容:必须出现的文字、数字、语言、品牌名和产品结构。
- 保持项:不得改变的人物、背景、构图、镜头、比例或未选区域。
- 输出规格:比例、方向、格数、语言和是否需要分步。
只有缺失信息会实质改变结果时才提问。把问题合并为一次;其余细节用保守假设继续,并在输出中标明。
2. 分析参考图
实际查看每张图片,不根据文件名猜内容。按上传顺序固定为 图1、图2……,提取可见主体、身份、姿势、场景、构图、风格、光影、颜色、材质、文字和标注。
为每张图分配明确角色:
图1:人物身份和背景
图2:姿势与手部动作
图3:服装与配饰
图4:需要手持的产品
文字看不清时请求用户提供准确文案,不猜字。图片没有实际提供时不伪装成已查看。
输入是编辑器或网页截图时,先识别真正的目标画布。圈选、箭头和工具栏作为控制信息;用户要求修改画面内容时默认输出干净画布,不把外围 UI 带入结果。
3. 识别任务类型
| task_type | 判断标准 |
|---|---|
generate |
无目标图,从文字生成新画面 |
edit |
修改一张目标图的指定内容 |
multi-reference |
两张以上图片分别提供人物、姿势、服装、产品或背景 |
style-transfer |
保留内容结构,迁移参考风格 |
information-visualization |
数据、知识、报告转视觉表达 |
ppt / poster / ecommerce |
生产型设计物料 |
storyboard |
多格漫画或影视镜头 |
character-design |
三视图、设定图、草图成品化 |
portrait / restoration |
人像修改、修复或老照片恢复 |
entertainment |
表情包、证件照、拍立得、社媒创意 |
读取 references/task-patterns.md 中对应章节。
4. 构造提示词
按任务选用顺序:
- 新图:主体 → 动作 → 场景 → 构图 → 风格 → 光影/色彩 → 材质细节 → 规格。
- 编辑:目标图 → 定位 → 修改 → 保持 → 光影/透视/材质融合。
- 多图:参考图分工 → 组合关系 → 主体一致性 → 空间与光影统一 → 保持项。
- 设计:用途/受众 → 准确内容 → 信息层级 → 版式 → 视觉主体 → 字体/色彩 → 规格。
- 分镜:全局连续性 → 每格景别/机位/动作 → 镜头衔接 → 风格/光线 → 文字要求。
写成自然、连贯、可直接粘贴的提示词。使用具体视觉描述,不堆砌同义形容词。
5. 处理文字
把所有必须生成的文字逐项列出并用引号包裹:
主标题为“Seedream 5.0 Pro”,副标题为“完整版生图测试”。
注明语言、位置、层级、字体气质和颜色。数据必须来自用户,不补造。信息图和复杂排版附一条简短提醒:小字需要生成后人工复核。
6. 控制编辑范围
使用正向保持指令:
仅替换图1中箭头所指的花束;保持人物身份、面部、服装、背景、构图、镜头和画面比例不变。
圈选、箭头、色块或涂鸦按可见标注描述。<point>x y</point> 只复制用户或工具提供的真实坐标,不自行估算。
7. 拆分复杂任务
满足任一条件时同时提供分步版:3 张以上参考图;同时改变人物/服装/背景/文字;大量数据和小字;复杂多格连续性;高身份一致性叠加强风格迁移。
顺序采用:主体与构图 → 对象融合 → 风格光影 → 准确文字与微小细节。完整提示词保留,分步版作为更稳选项。
8. 自检
交付前逐项确认:
- 每张参考图都有编号、角色,并在提示词中被引用。
- 修改项和保持项边界清楚。
- 主体、风格、光影和构图已覆盖。
- 准确文字逐字出现并被引号包裹。
- 坐标来自用户或工具。
- 比例、格数、语言和用途没有矛盾。
- 高复杂度任务提供分步版。
- 没有承诺像素级 UI、绝对文字准确率或完全替代专业定稿。
需要保存机器可读结果时,复制 assets/prompt-package.template.json 填写,并运行:
python scripts/validate_prompt.py <prompt-package.json>
输出格式
默认先给可直接使用的结果:
## Seedream 5.0 Pro 提示词
```text
[最终提示词]
```
按需追加:
参考图分工:仅多图任务。分步提示词:仅复杂任务。需要确认:仅存在关键缺口。能力边界:仅触发小字、精确 UI、侵权或其它真实风险。
用户说“只要提示词”时,只输出提示词代码块,不解释过程。
边界
- 只写提示词;用户明确要求出图时再调用图像生成工具。
- 不把图片描述冒充官方原提示词。
- 不编造图片内容、坐标、数据、品牌文案或文化细节。
- 不为违规、侵权或不合规视觉请求提供执行性提示词。