GPT Image 系列 完全指南:从文生图到图像编辑、风格控制
用 GPT Image 2 与 Images API 稳定产出高质量图片:提示词结构、风格控制、图像编辑与成本控制。
操作步骤
写一条结构化的 prompt
用「主体 + 风格 + 镜头/光圈 + 背景 + 比例」五段式:"一只橘猫坐在窗台,写实风格,浅景深,柔光背景,3:2"。
调 Images API 生成第一张图
POST /v1/images/generations,body 含 model="gpt-image-2"、prompt=...、size="1024x1024"、quality="medium"、n=1。返回 b64_json。
选风格:natural 写实 vs vivid 夸张
vivid 偏戏剧化、色彩更饱和;natural 偏写实、克制。同一 prompt 用两个值各跑一次,挑你要的。
用编辑接口做局部 inpainting
POST /v1/images/edits,把原图 + 同尺寸的 PNG 蒙版(透明区域 = 要重绘的部分)+ prompt 一起发;模型只重绘蒙版区。
商用前自查 Usage Policy
查 openai.com/api/pricing 拿最新版价格;不要生成真实人物、未授权品牌、违禁内容;商用素材要在 metadata 里保留 provenance。
GPT Image 系列 是 OpenAI 的文生图模型系列:GPT Image 2(2026-04-21)通过 ChatGPT 与 Images API 均可调用,支持文生图、图像编辑、变体生成;后继 GPT Image 2.5(sunburst / flare)于 2026-09-08 进入官方 SDK 类型。
1. 概述
GPT Image 2 是 OpenAI 的主力文生图模型之一(2026-09-08 起后继 GPT Image 2.5 已进入官方 SDK),质量远超前代,但提示词写法、风格控制、图像编辑都有讲究。本文从 prompt 框架、风格关键词、inpainting、outpainting 到 cost 给你一份完整手册。
2. 核心要点
- GPT Image 2 prompt 公式:主体 + 风格 + 镜头/光圈 + 背景 + 比例;越具体越好
- 支持 natural 与 vivid 两种风格:natural 偏写实,vivid 偏夸张艺术化
- 图像编辑(edits)支持上传蒙版做局部 inpainting;扩展(variations)生成同主题变体
- 通过 Images API 可指定 size(1024x1024、1024x1536、1536x1024,或 'auto')、quality(low / medium / high)、n(生成数量)
- 按 output token 计价(约 $40/百万 token);质量越高、尺寸越大越贵——商用前看官方 Usage Policy
3. 工作机制
下面分节展开。建议阅读时配合 OpenAI 官方文档 一起看。
4. 实战步骤
- 明确目标:先定义完成的标准。
- 选型:参考核心要点里的模型对比。
- 验证:跑通最小示例,记录参数与版本号。
- 集成:把示例接到你现有代码里。
- 监控:记录调用日志与失败原因,定期回看。
5. 常见错误与排查
- 报错 401:API Key 无效或过期,重新生成。
- 报错 429:触发速率限制,启用指数退避重试。
- 报错 400:参数错误,仔细核对 model 名称与 messages 结构。
- 回答质量差:换模型、补充 few-shot 示例、检查 prompt 是否过长。
6. 下一步
掌握本文后,建议继续阅读:
- 《ChatGPT 完全指南(2026):从入门到精通》
- 《Prompt Engineering 核心模式:8 个让 GPT 表现翻倍的模板》
- 《OpenAI API 入门:第一个 GPT-5.6 调用详解》
关键要点
- GPT Image 2 prompt 公式:主体 + 风格 + 镜头/光圈 + 背景 + 比例;越具体越好
- 支持 natural 与 vivid 两种风格:natural 偏写实,vivid 偏夸张艺术化
- 图像编辑(edits)支持上传蒙版做局部 inpainting;扩展(variations)生成同主题变体
- 通过 Images API 可指定 size(1024x1024、1024x1536、1536x1024,或 'auto')、quality(low / medium / high)、n(生成数量)
- 按 output token 计价(约 $40/百万 token);质量越高、尺寸越大越贵——商用前看官方 Usage Policy
常见问题
官方参考
相关文章
GPT Image 2.5 解读:sunburst / flare 双模型、xhigh-max 质量档与任意分辨率
GPT Image 2.5 已进入官方 SDK(openai-python v3.10.0 / openai-node v7.12.0):sunburst 与 flare 双模型、xhigh/max 质量档、任意分辨率(16 整除、比例 1:3–3:1)、透明背景。逐项拆解参数规则并给出可复制的生成与编辑示例。
阅读全文GPT Image 2 API 实战:从文生图到图像编辑
DALL·E 退场后的官方图像 API。本文讲清 GPT Image 2 的生成与编辑调用、b64 输出的落盘处理、quality 等参数,以及从 ChatGPT 内生成到 API 的分工。
阅读全文GPT Image 2 vs Midjourney vs DALL·E 3:三大图像生成模型实战对比(2026)
GPT Image 2 / Midjourney / DALL·E 3 三大图像生成模型实战对比:图像质量 / 文字渲染 / 一致性 / 价格 / 商业版权。文末给选型决策表 + 企业混合工作流。
阅读全文订阅 GPTMap Weekly
每周一封邮件,精选 OpenAI 重要更新、深度解读与最佳实践。无广告,可随时退订。
提交后将在新标签页打开 Buttondown 完成订阅确认。