# Gpt Image

> TikBit AI 工作台对话式 GPT 生图工具。用户要求生成、修改、合成或批量生成图片时调用。

- Skill: `startupsalad/gpt-image` (Agent Skill, multi-file: 6 files)
- Install (CLI): `npx skillmds@latest add startupsalad/gpt-image`
- Raw SKILL.md: https://api.skillmd.com/api/skills/startupsalad/gpt-image/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: startupsalad (https://skillmd.com/u/startupsalad)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/startupsalad/gpt-image

---


# GPT 生图工具

## 适用范围

本 Skill 只在 TikBit AI 工作台内使用。它服务于“AI 在对话过程中调用生图”，不替代给用户手动操作的图片工作室，也不负责制作完整 PPT。

## 触发条件

用户出现以下意图时调用：

- “生成一张图/封面/插画/海报背景”
- “把这张图改成……/换背景/换风格”
- “把这几张参考图合成一张”
- “按这个清单批量出图”

如果用户只是问创意、要写提示词，先给文字方案，不调用 API。涉及付费调用时，先确认画面内容、尺寸、数量和输出位置。

## 出图档位：本轮第一次生图前先问

模型有两档，速度和精细度是真实取舍（实测 2026-09-09）：

| 档位 | 模型 | 单张耗时 | 适合 |
|---|---|---|---|
| 精细 | `gpt-image-2.5-sunburst` | 约 30~50s | 对客物料、正式海报、要交付的成品 |
| 快速 | `gpt-image-2.5-flare` | 约 16~26s | 草稿、占位图、探索方向、批量出图 |

规则：

1. **本轮对话第一次要生图时，先用一句话问用户**：要快一些还是精细一些。别列参数表，就问这一句。
2. **用户答过之后，同一话题后续生图直接沿用，不再重复问。** 用户中途说“这次快点/这张要精细”就当场切换，并沿用到之后。
3. 用户已经在需求里说清了（“先出几张草稿看看方向”“这张是给客户的成品”），**不用多问一遍**，按语义选档并在回复里一句话说明选了哪档。
4. 批量出图（`--batch`）默认建议快速档，出图后再挑中的用精细档重出。

命令行用 `--model 精细` / `--model 快速`（也认 `fast` / `flare` / `sunburst`）。不带 `--model` 时走配置里的默认档（精细）。

## 调用规则

执行器位置：`~/.tikbit/gpt-image/gpt-image.js`。Windows 将 `~` 展开为用户目录。

### 单张文生图

```text
node ~/.tikbit/gpt-image/gpt-image.js "<经过整理的图片描述>" --size 1024x1024 --model 精细 --output "<项目相对路径>.png"
```

### 参考图编辑

```text
node ~/.tikbit/gpt-image/gpt-image.js "<修改要求>" --reference "<参考图路径>" --model 精细 --output "<项目相对路径>.png"
```

多张参考图用逗号分隔。不要把用户未授权的私人图片上传到 API。

### 批量生成

```text
node ~/.tikbit/gpt-image/gpt-image.js --batch "<任务清单路径>" --concurrency 3 --model 快速
```

默认并发 3；上游报 429 或慢 5xx 时降到 1，不要盲目提高并发。

### 尺寸档位

上游约束：最长边 ≤ 3840，总像素 ≤ 8,294,400。`3840x2160` 会返回真实 4K
（旧的 gpt-image-2 会静默降级到 2048，2.5 起不再降级）。`4096x4096` 和 `3840x3840` 都会被 400 拒绝。

## 提示词处理

把用户的自然语言整理为清晰的主体、场景、构图、光线、风格、色彩和尺寸要求。不要擅自添加品牌、人物、地点、价格、日期等事实。图片需要中文文字时，先提醒模型文字渲染可能出错；信息型版面优先改用 HTML/截图流程。

## 配置和错误

- 缺 API：停止调用，告诉用户需要在本机配置 `GPT_API_KEY` 与 `GPT_BASE_URL`，不要索取或回显密钥。
- 401/403/400：检查本机配置、模型名和参数后再重试，不要重复刷接口。
- 429：降低并发，等待后重试。
- 502/503/504/524 或读超时：按执行器提示重试有限次数；连续失败时如实报告，不伪造图片已生成。

成功后把实际输出路径和图片嵌入当前对话（若工作台支持），并简要说明尺寸和生成数量。

