GPT 模型完全指南(2026-07):GPT-5.6 Sol / Terra / Luna 选型
GPT 模型完全指南(2026-07):OpenAI 当前的旗舰模型家族是 2026-07-09 发布的 GPT-5.6(Sol/Terra/Luna),配套有 GPT-Realtime-2.1 语音族与 GPT Image 2 图像族。本文按价格-能力梯队给出选型决策树与典型工作负载。
GPT 模型完全指南(2026-07):GPT-5.6 Sol / Terra / Luna 选型
OpenAI 在 2026-07-09 把旗舰模型收敛为 GPT-5.6 家族——按价格-能力分三档 Sol / Terra / Luna,共用同一组技术特性。这一篇带你在 5 分钟内看清三档区别,并给出一条选型决策树。
1. 2026-07-14 速览
| 档位 | model alias | 输入 / 输出价格(每 MTok) | 上下文 | max output | 知识截止 | 定位 |
|---|---|---|---|---|---|---|
| GPT-5.6 Sol | gpt-5.6-sol(alias gpt-5.6) | $5 / $30 | 1.05M | 128K | 2026-02-16 | Frontier,复杂专业工作 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 / $15 | 1.05M | 128K | 2026-02-16 | 智能与成本平衡 |
| GPT-5.6 Luna | gpt-5.6-luna | $1 / $6 | 1.05M | 128K | 2026-02-16 | 低成本,高吞吐批处理 |
数据源:
developers.openai.com/api/docs/models(GPT-5.6 家族条目),抓取于 2026-07-14。
三档共用: 1.05M 上下文、128K 输出、2026-02-16 知识截止、原生多模态(文本/图像/音频/文件)、reasoning.effort=none/low/medium/high/xhigh/max 六档控制深度。
2. 选型决策树
按工作负载走下面顺序判断:
- 分类 / 抽取 / 翻译等大批量小任务? →
gpt-5.6-luna+reasoning={"effort": "none"} - 日常聊天 / 写作 / 长文档问答? →
gpt-5.6-terra+reasoning={"effort": "medium"} - 长代码 / 多步 Agent / 复杂规划? →
gpt-5.6-sol+reasoning={"effort": "high"}或xhigh - 数学竞赛 / 科研分析 / 最深推理? → 切到 o-series 推理模型(reasoning.effort 固定为 max)
判断"够不够用":让模型自评输出质量,把没把握的请求自动升档到 Sol,把明显浪费的请求降档到 Luna。OpenAI 在 Responses API 里提供 model router 做这件事。
3. API 调用示例(Responses API + Python)
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6", # alias = Sol;要换档改 model id
input=[
{"role": "system", "content": "你是资深 Python 导师"},
{"role": "user", "content": "用 1 句话解释什么是装饰器?"},
],
reasoning={"effort": "medium"}, # none / low / medium / high / xhigh / max
max_output_tokens=200,
)
print(response.output_text)
print("tokens used:", response.usage.total_tokens)
要换档只需改 model:
- 复杂推理 →
model="gpt-5.6-sol"+reasoning={"effort": "xhigh"} - 高吞吐批处理 →
model="gpt-5.6-luna"+reasoning={"effort": "none"} - 日常主力 →
model="gpt-5.6-terra"+reasoning={"effort": "medium"}
4. 配套模型(不要混进主目录)
| 用途 | 当前模型 | 备注 |
|---|---|---|
| 语音旗舰 | GPT-Realtime-2.1(2026-07-06) | WebRTC / WebSocket,mid-conversation 工具调用 |
| 语音低成本 | GPT-Realtime-2.1 mini(2026-07-06) | 同上但更便宜 |
| 语音翻译 | GPT-Realtime-Translate(2026-05-07) | 流式 speech-to-speech |
| 语音流式 STT | GPT-Realtime-Whisper(2026-05-07) | realtime 场景转写 |
| 图像生成 | GPT Image 2(2026-04-21) | DALL·E 2 / DALL·E 3 在 2026-05-12 下线 |
| 嵌入 | text-embedding-3-large / text-embedding-3-small | 向量检索 |
| 转写 | GPT-Realtime-Whisper / GPT-4o Transcribe / GPT-4o mini Transcribe | 文本转写 |
| 视频 | sora-2 / sora-2-pro | 2026-03-12 起 1080p 支持 |
历史:
- 2026-05-12
DALL·E 2 / DALL·E 3 与 Realtime API Beta已从 API 下线。- 2025-2026 间还发布过 GPT-5 / GPT-5.5 / GPT-5.4 等(按时间依次迭代),现在对外主推已是 5.6 家族。
5. 2026-07 之前的关键迁移
如果你正在用老模型,按下面顺序迁移:
- GPT-4o / GPT-4 Turbo / GPT-4.1 →
gpt-5.6-terra(最接近,行为兼容) - o1 / o1 pro / o3-mini / o-series →
gpt-5.6-sol+reasoning={"effort": "high"}或xhigh - GPT-5 / GPT-5.5 / GPT-5.5 Pro →
gpt-5.6-sol - DALL·E 3 → GPT Image 2(DALL·E 3 已下线)
- gpt-4o-realtime-preview(旧 ID) → GPT-Realtime-2.1 或 2.1 mini
- Chat Completions(messages 字段) → Responses API(input 字段)
6. 常见错误与排查
- 报错 401:API Key 无效或过期,重新生成。
- 报错 429:触发速率限制,加指数退避重试;或把 Sol 降到 Terra / Luna。
- 报错 400:参数错误。常见是把
messages用在 Responses API(要用input),或在 Sol 上下文里塞了过大的图片。 - 回答质量差:把
reasoning.effort从low提到medium/high,或换到 Sol。检查 prompt 是否过长,把不必要的历史截掉。 - 速度太慢:把 Sol 降到 Terra;或者保留 Sol 但把
reasoning.effort降到low。
7. 下一步
掌握本文后,建议继续阅读:
- 《OpenAI 模型更新日志(持续更新)》— 与官方 changelog 同步的"living document"
- 《OpenAI API 入门:第一个 GPT-5.6 调用详解》
- 《ChatGPT 完全指南(2026):从入门到精通》
数据来源与抓取日期: 本页 GPT-5.6 家族描述、价格、上下文、知识截止等数据来自 developers.openai.com/api/docs/models 与 developers.openai.com/api/docs/changelog,抓取于 2026-07-14。每次大版本变动我们会重抓并把 dataSourcedAt 同步更新;与官方不符时以官方为准。
关键要点
- GPT-5.6 三档共享:1.05M 上下文、128K 输出、知识截止 2026-02-16、原生多模态;只差价格、速度与默认能力
- GPT-5.6 Sol:$5 / $30 per MTok,flagship / 'Frontier model for complex professional work'
- GPT-5.6 Terra:$2.50 / $15 per MTok,'GPT-5.6 model that balances intelligence and cost'——日常主力
- GPT-5.6 Luna:$1 / $6 per MTok,'GPT-5.6 model optimized for cost-sensitive workloads'——批处理/分类/抽取
- 三档都用同一个 alias `gpt-5.6`,通过 reasoning.effort=none→max 控制深度;前端代码不用改
- Chat Completions 已进入 legacy 阶段,新项目用 Responses API(input 字段,不是 messages)
- 2026-05-12 起 DALL·E 2/3 与 Realtime API Beta 已下线;改用 GPT Image 2 与 GPT-Realtime-2.1
❓ 常见问题
官方参考
订阅 GPTMap Weekly
每周一封邮件,精选 OpenAI 重要更新、深度解读与最佳实践。无广告,可随时退订。