GPT 生图工具
适用范围
本 Skill 只在 TikBit AI 工作台内使用。它服务于“AI 在对话过程中调用生图”,不替代给用户手动操作的图片工作室,也不负责制作完整 PPT。
触发条件
用户出现以下意图时调用:
- “生成一张图/封面/插画/海报背景”
- “把这张图改成……/换背景/换风格”
- “把这几张参考图合成一张”
- “按这个清单批量出图”
如果用户只是问创意、要写提示词,先给文字方案,不调用 API。涉及付费调用时,先确认画面内容、尺寸、数量和输出位置。
出图档位:本轮第一次生图前先问
模型有两档,速度和精细度是真实取舍(实测 2026-09-09):
| 档位 | 模型 | 单张耗时 | 适合 |
|---|---|---|---|
| 精细 | gpt-image-2.5-sunburst |
约 30~50s | 对客物料、正式海报、要交付的成品 |
| 快速 | gpt-image-2.5-flare |
约 16~26s | 草稿、占位图、探索方向、批量出图 |
规则:
- 本轮对话第一次要生图时,先用一句话问用户:要快一些还是精细一些。别列参数表,就问这一句。
- 用户答过之后,同一话题后续生图直接沿用,不再重复问。 用户中途说“这次快点/这张要精细”就当场切换,并沿用到之后。
- 用户已经在需求里说清了(“先出几张草稿看看方向”“这张是给客户的成品”),不用多问一遍,按语义选档并在回复里一句话说明选了哪档。
- 批量出图(
--batch)默认建议快速档,出图后再挑中的用精细档重出。
命令行用 --model 精细 / --model 快速(也认 fast / flare / sunburst)。不带 --model 时走配置里的默认档(精细)。
调用规则
执行器位置:~/.tikbit/gpt-image/gpt-image.js。Windows 将 ~ 展开为用户目录。
单张文生图
node ~/.tikbit/gpt-image/gpt-image.js "<经过整理的图片描述>" --size 1024x1024 --model 精细 --output "<项目相对路径>.png"
参考图编辑
node ~/.tikbit/gpt-image/gpt-image.js "<修改要求>" --reference "<参考图路径>" --model 精细 --output "<项目相对路径>.png"
多张参考图用逗号分隔。不要把用户未授权的私人图片上传到 API。
批量生成
node ~/.tikbit/gpt-image/gpt-image.js --batch "<任务清单路径>" --concurrency 3 --model 快速
默认并发 3;上游报 429 或慢 5xx 时降到 1,不要盲目提高并发。
尺寸档位
上游约束:最长边 ≤ 3840,总像素 ≤ 8,294,400。3840x2160 会返回真实 4K
(旧的 gpt-image-2 会静默降级到 2048,2.5 起不再降级)。4096x4096 和 3840x3840 都会被 400 拒绝。
提示词处理
把用户的自然语言整理为清晰的主体、场景、构图、光线、风格、色彩和尺寸要求。不要擅自添加品牌、人物、地点、价格、日期等事实。图片需要中文文字时,先提醒模型文字渲染可能出错;信息型版面优先改用 HTML/截图流程。
配置和错误
- 缺 API:停止调用,告诉用户需要在本机配置
GPT_API_KEY与GPT_BASE_URL,不要索取或回显密钥。 - 401/403/400:检查本机配置、模型名和参数后再重试,不要重复刷接口。
- 429:降低并发,等待后重试。
- 502/503/504/524 或读超时:按执行器提示重试有限次数;连续失败时如实报告,不伪造图片已生成。
成功后把实际输出路径和图片嵌入当前对话(若工作台支持),并简要说明尺寸和生成数量。