GPT Image 2 提示词公式与商业使用边界
GPT Image 2 是当前主推的图像模型(DALL·E 2/3 已下线)。本文给出 5 段式提示词公式、风格控制(natural / vivid)、尺寸质量参数、商业使用前的 Usage Policy 自查清单。
操作步骤
用 5 段式提示词写第一句
主体 → 场景/背景 → 光线 → 风格 → 构图/镜头;每段 1-2 个关键词,避免堆砌形容词。
调 Images API
client.images.generate(model='gpt-image-2', prompt=..., size='1024x1024', quality='medium', style='natural', n=1);返回 b64_json 或 url。
选 natural 还是 vivid
产品/写实场景选 natural,营销/概念/海报选 vivid;不确定用 natural。
做图像编辑(inpainting)
传 image(PNG 原图)、mask(透明区域是要改的部分)、prompt(描述新内容);模型只重绘 mask 区。
商用前自查
查 Usage Policy:不要生成名人/政客肖像、医疗图、误导图、版权作品复刻;OK 再发布。
GPT Image 2(2026-04-21 发布)已替代 DALL·E 2/3 成为 OpenAI 唯一图像生成模型。这篇给提示词公式、风格控制、API 参数、以及商用前的 Usage Policy 自查清单。
1. 5 段式提示词公式
写出"想要的画面"靠五段描述:
[主体] 谁/什么
[场景/背景] 在哪里
[光线] 怎么照的
[风格] 什么艺术风格
[构图/镜头] 怎么取景
例 1(产品图):
"一只深蓝色陶瓷咖啡杯,放在木桌上,清晨窗边的柔和侧光,自然摄影风格,中景镜头,浅景深。"
例 2(营销海报):
"一个年轻女性站在霓虹城市街头,背景是巨型广告牌,雨夜反射光,赛博朋克风格,广角镜头,高对比度。"
每段 1-2 个关键词,避免堆砌——"非常极其特别的 beautiful" 不如 "minimal, elegant"。
2. natural vs vivid 风格
| 风格 | 色彩 | 光线 | 适合 |
|---|---|---|---|
| natural(默认) | 平衡、真实 | 自然、克制 | 产品图、人像、风景、写实场景 |
| vivid | 浓烈、戏剧 | 高对比、戏剧 | 营销海报、概念图、风格化插画 |
不确定就选 natural——它不会出错;vivid 容易过度饱和。
3. Images API 参数
from openai import OpenAI
client = OpenAI()
result = client.images.generate(
model="gpt-image-2",
prompt="...",
size="1024x1024", # 1024x1024 / 1024x1792 / 1792x1024
quality="medium", # low / / medium / / high / auto
style="natural", # natural / vivid
n=1, # 单次生成数量,建议 2-4 一次拿多张
)
image_bytes = result.data[0].b64_json # 或 .url
参数选型:
size:方形(1024×1024)社交媒体通用;竖屏(1024×1792)适配手机屏;横屏(1792×1024)网站 bannerquality:auto让模型自选;明确用途就medium(社媒)或high(印刷/大屏)n:一次请求 n=4 比 4 次请求便宜 4 倍——API 计费是按"次"而非按"图"
4. 图像编辑(inpainting / outpainting)
Inpainting:传原图 + mask(透明区域)+ prompt,模型只重绘 mask 区域。
from openai import OpenAI
import base64
client = OpenAI()
# 原图与 mask 都读成 base64
with open("original.png", "rb") as f:
image_b64 = base64.b64encode(f.read()).decode()
with open("mask.png", "rb") as f:
mask_b64 = base64.b64encode(f.read()).decode()
result = client.images.edit(
model="gpt-image-2",
image=image_b64,
mask=mask_b64,
prompt="一只猫坐在椅子上",
size="1024x1024",
)
Outpainting:把图片往画布外扩展,常用于把横图扩成竖图、或给图加边框。
常见用途:换背景、修局部、加元素、把方图扩成 banner。
5. 商业使用边界(必读 Usage Policy)
OpenAI 允许商用 GPT Image 2 生成的图像,但有硬线:
| 禁止 | 解释 |
|---|---|
| 名人/政客肖像 | 即使艺术化也不行 |
| 医疗诊断图 | 不可用于医疗建议 |
| 误导性图像 | 伪造的新闻图、虚假证据 |
| 版权作品复刻 | 模仿某个在世艺术家风格可能有版权风险 |
| 训练竞品 | 不得用于训练非 OpenAI 的图像模型 |
商用前自查清单:
- 主体不在名人/政客肖像名单
- 不涉及医疗诊断建议
- 发布时明确标注"AI 生成"(部分司法管辖区强制要求)
- 模仿风格时确认原艺术家作品仍在版权期
- prompt 不含可能误导的元素
6. 常见错误与排查
- 生成的图不像 prompt 描述 → 提示词太抽象;用 5 段式重新拆解
- 手指/眼睛/文字不自然 → GPT Image 2 比 DALL·E 3 显著改善,但极端情况下仍可能出;选 natural 风格或换 prompt 重试
- 风格太夸张 → style 改 natural 或 quality 改 medium
- 生成的人像像某个真人 → 不发布;这通常意味着 prompt 含了真实姓名
- 商用后收到版权警告 → 自查 Usage Policy;如有模仿在世艺术家风格,移除
7. 下一步
- 《GPT Image 系列 完全指南:从文生图到图像编辑、风格控制》
- 《OpenAI API 入门:第一个 GPT-5.6 调用详解》
- 《OpenAI API 函数调用实战:Responses API 工具使用完全指南》
关键要点
- 5 段式提示词:主体 → 场景/背景 → 光线 → 风格 → 构图/镜头;越具体越好
- natural 风格贴近真实摄影、vivid 风格更夸张有戏剧性;默认 natural
- size 参数控制输出尺寸(1024x1024 / 1024x1792 / 1792x1024),quality 控制细节(low / medium / high / auto)
- n 控制单次生成数量;一次请求 n=4 比 4 次请求便宜 4 倍
- 商业使用前必查 Usage Policy:禁止名人肖像、医疗诊断、误导性图像、版权材料再创作
- 图像编辑(inpainting / outpainting)传 image + mask 字段;模型基于 mask 区域重绘
常见问题
官方参考
相关文章
订阅 GPTMap Weekly
每周一封邮件,精选 OpenAI 重要更新、深度解读与最佳实践。无广告,可随时退订。