GPT-6-Astra 落地:进入 Codex 模型选择器与 Amazon Bedrock 目录
2026-09-09 的 Codex CLI 0.154.0 把 GPT-6-Astra 带进模型选择器首位与 Amazon Bedrock 目录,随附官方迁移指南确认 Responses API 以 model=gpt-6-astra 调用,并给出六档推理、async 工具调用与参数清理清单。定价数字仍未见官方渠道。
GPT-6-Astra 是 OpenAI 的下一代旗舰模型,2026-09-09 随 Codex CLI 0.154.0 正式进入可用面:模型选择器把它列在首位,Amazon Bedrock 目录出现 openai.gpt-6-astra,随版本捆绑的官方迁移指南确认 Responses API 以 model: "gpt-6-astra" 即可调用。距离它首次现身 SDK 类型层(2026-09-03 的 openai-python v3.8.0 / openai-node v7.10.0,详见《gpt-6-astra 现身 OpenAI SDK:ChatModel 枚举新模型 ID 与 Safety Alerts API 解读》)只过了六天。
本文全部事实来自 2026-09-15 当日可加载的 GitHub 工件:openai/codex 仓库的 release notes、PR diff、rust-v0.154.0 tag 的捆绑文件。OpenAI 官方文档域(openai.com / developers.openai.com)当日对本站仍返回 403,所以凡涉及官方页面的状态一律日期锚定,定价数字未见即写未见。
1. 概述:六天从类型层走到可选用的完整时间线
| 日期 | 事件 | 可复现来源 |
|---|---|---|
| 2026-09-03 | 进入 openai-python v3.8.0 / openai-node v7.10.0 的 ChatModel 枚举首位,同批落地 Safety Alerts API | 两包 GitHub release + tag 源码 |
| 2026-09-03 | openai/codex PR #42619:加入 Amazon Bedrock 模型目录 | PR diff |
| 2026-09-04 | openai/codex PR #42879:模型选择器 visibility 设为 list,排首位 | PR diff + models.json |
| 2026-09-05 | openai/codex PR #42931:捆绑的 OpenAI Docs skill 迁移指南由 GPT-5.6 Sol 版替换为 GPT-6 Astra 版 | PR diff |
| 2026-09-09 | Codex CLI 0.154.0 发布,release notes 原文 "GPT-6-Astra is now available in the model picker and Amazon Bedrock catalogs" | GitHub release |
CLI 0.154.0 的发布说明把这条链收口成一句话,而链上的每个环节都能在仓库里逐字指出——这正是本文的写法。
2. 选择器与 Bedrock:两个 PR 各做了什么
2.1 模型选择器:visibility=list,排序第一
PR #42879 的改动很小但信号很强:把 GPT-6-Astra 的捆绑模型可见性设为 list,让它出现在交互式模型选择器里,并排在第一位。rust-v0.154.0 tag 的 models.json 可以交叉验证:gpt-6-astra 的 priority 是 1,而 GPT-5.6 三档分别排在 6、7、8 位。
同一文件还标注 minimal_client_version: 0.153.0——字段含义是对客户端版本的最低要求。
2.2 Amazon Bedrock:openai.gpt-6-astra 双区域变体
PR #42619(与 SDK 类型层出现同日合并)把 openai.gpt-6-astra 加入 Amazon Bedrock 模型目录,Bedrock Runtime 目录同时收录其全球变体与美区 cross-region 变体,并按 Bedrock 的方式套用平台特定的能力标识与上下文窗口覆盖。OpenAI 模型家族进入 Bedrock 已非首次——GPT-5.4 / GPT-5.5 在 2026-06 走过同一条路。
3. Codex 捆绑元数据读出的能力面
models.json(rust-v0.154.0 tag,2026-09-15 核对)里 gpt-6-astra 条目的关键字段:
| 字段 | 值 | 说明 |
|---|---|---|
| context_window | 272000 | Codex 侧运行窗口 |
| max_context_window | 872000 | experimental context 上限 |
| supported_in_api | true | 元数据标注支持 API 调用 |
| priority | 1 | 选择器排序首位 |
| minimal_client_version | 0.153.0 | 旧客户端不可见 |
| input_modalities | text, image | 无音频输入 |
| tool_mode | code_mode_only | 工具走代码模式 |
| web_search_tool_type | text_and_image | 网页搜索可带图 |
| multi_agent_version | v2 | 多智能体编排(xhigh 档) |
| default_reasoning_level | low | 默认推理档 |
3.1 推理六档:ultra 的官方描述是"自动任务委托"
gpt-6-astra 的 supported_reasoning_levels 共六档,每档带官方描述:
| 档位 | 官方描述(原文) |
|---|---|
| low | Fast responses with lighter reasoning |
| medium | Balances speed and reasoning depth for everyday tasks |
| high | Greater reasoning depth for complex problems |
| xhigh | Extra high reasoning depth for complex problems |
| max | Maximum reasoning depth for the hardest problems |
| ultra | Maximum reasoning with automatic task delegation |
两点值得划线:不支持 none 档(官方指南的 Limitations 一节明确写了);ultra 的描述比 max 多出 "automatic task delegation"——推理之外还会自动委托任务。Codex 的系统提示基座也在这个版本改成了 "You are Codex, an agent based on GPT-6"。
3.2 272K / 872K 是 Codex 运行窗口,别当成 API 模型卡
models.json 是 Codex 自己的运行配置,不是 API 模型卡:同一文件里 GPT-5.6 三档的窗口同样是 272K/872K,而它们在 API 侧的既有设定是 1.05M 上下文。所以本文不把这两个数字写成 gpt-6-astra 的"上下文规格"——它是"Codex 里跑多大",不是"API 里允许多大"。
4. 随附官方迁移指南的要点
PR #42931 把捆绑的 OpenAI Docs skill 里那份 GPT-5.6 Sol 迁移指南整个替换成了 GPT-6 Astra 版(upgrading-to-gpt-6-astra.md)。这份文件是官方指南的快照,其头部声明"以 live 文档为权威"(live 地址为 developers.openai.com 的 latest-model/gpt-6-astra 页,当日对本站 403)。快照正文四块内容最值钱:
4.1 四项新能力
- async tool calling:给 function / custom 工具设
async: true,应用照常执行工具并管理挂起工作,模型在等待期间可继续推理、调用其他工具或回答请求中独立的部分;就绪后用原来的 call_id 回传结果。 - mid-turn steering:在 WebSocket 连接上向正在工作的模型发送补充指令(纠正、需求变更),Responses API 保留已完成工作并把更新并入续写。
- configuration_update 输入项:会话中途提高或降低
reasoning.effort,而不重写原始 prompt 前缀——缓存命中率得以保留;新档位生效到下一次configuration_update覆盖为止。 - misalignment monitoring:系统异步监测模型失准行为并在必要时触发告警,与 9 月初 SDK 里出现的 Safety Alerts API 同一脉络。
4.2 限制与迁移清理清单
官方指南给出的迁移改动,逐条可执行:
| 迁移项 | 官方要求 |
|---|---|
| 工具调用 | 必须走 Responses API;Chat Completions 本身可用但工具调用不行 |
| 采样参数 | 移除 temperature / top_p / top_logprobs;Chat Completions 另移 logprobs;Responses 从 include 移除 message.output_text.logprobs |
| 推理档 | 原来用 none / minimal 的从 low 起步;其余保持原有效档位 |
| 缓存 | GPT-5.5 及更早的 prompt_cache_retention 改为 prompt_cache_options.ttl 设 30m |
| EU 数据驻留 | 无 fast / priority 服务档;fast mode 无延迟 SLA |
4.3 角色映射:Sol 换 Astra,Terra / Luna 不动
指南按"角色"给迁移映射:GPT-5.6 Sol 或更早旗舰 → gpt-6-astra(原文 "Astra is the flagship-equivalent tier");均衡负载继续用 Terra;速度与成本敏感继续用 Luna(原文 "retain Terra for balanced work and Luna as the primary faster or cheaper model")。选择器与注册表默认追加 Astra 而保留 Terra / Luna 条目,除非用户明确要求替换。
5. 定价为什么仍写"未核实"
指南快照只留了一句定性:Astra 用更少的输出 token 达成更强结果,每任务估算 API 成本低于前代,尽管其每 token 单价更高(原文 "despite its higher per-token pricing")——没有任何数字。截至 2026-09-15,openai.com 与 developers.openai.com 对本站均 403,定价页无法核对;GitHub 侧所有工件也不含价格。所以本文保守地写:定价数字未见官方渠道,迁移预算评估等官方定价页可访问后为准。
6. 如何自行核实
任一能访问 GitHub 的环境,四条命令复现本文核心事实:
# 事实 1:CLI 0.154.0 发布说明里的 Astra 条目
curl -s https://api.github.com/repos/openai/codex/releases/tags/rust-v0.154.0 | grep -i astra
# 事实 2:models.json 里 gpt-6-astra 的窗口、优先级、推理档
curl -s https://raw.githubusercontent.com/openai/codex/rust-v0.154.0/codex-rs/models-manager/models.json | python3 -m json.tool | grep -A 30 '"slug": "gpt-6-astra"'
# 事实 3:随附官方迁移指南全文
curl -s https://raw.githubusercontent.com/openai/codex/rust-v0.154.0/codex-rs/skills/src/assets/samples/openai-docs/references/upgrading-to-gpt-6-astra.md | head -40
# 事实 4:Bedrock 与选择器两个 PR
curl -s https://api.github.com/repos/openai/codex/pulls/42619 | python3 -c "import json,sys; print(json.load(sys.stdin)['title'])"
顺带一提:models.json 里还有两个 visibility: hide 的隐藏条目 gpt-daybreak-blue-latest / gpt-daybreak-red-latest,对应 OpenAI 2026-08-07 已公告的 Daybreak 分层(Blue 通用防御性安全、Red 单独审批),复现命令看到它们不要意外。
7. 常见误读与排查
- 把 Codex 窗口当 API 规格:272K/872K 是 Codex 侧运行窗口,GPT-5.6 在同一文件里也是这两个值;API 侧规格以官方模型卡为准(当日 403,未核对)。
- 把
ultra写进非 Codex 调用:ultra目前只见于 Codex 捆绑元数据;对 Responses API 直接传未文档化的档位值,行为没有保障。 - 带着采样参数直接换模型名:
temperature/top_p/top_logprobs在 gpt-6-astra 上属不支持参数,迁移时按 4.2 清单清理,否则报错责任在自己。 - 在 Chat Completions 里用工具调用:官方明说工具调用必须走 Responses——仍在 Chat Completions 上的项目先迁 API 形态再换模型。
- EU 数据驻留场景开 fast mode:该组合官方不可用,别在合规敏感部署里假设延迟档存在。
- 立刻全量切换:指南自己的建议是按角色映射、追加而非替换,并保留回退路线;灰度验证矩阵(旧模型旧 prompt vs 新模型保持档位 vs 降一档)官方给了五步对照法。
8. 下一步
- 《gpt-6-astra 现身 OpenAI SDK:ChatModel 枚举新模型 ID 与 Safety Alerts API 解读》:六天前的上一篇——类型层首现与 Safety Alerts API 的完整拆解。
- 《Codex CLI 0.154.0 与 SDK 0.154.0 发布解读:worktree、ExternalMessage 与 ultra 推理档》:同版本 CLI 与 SDK 的其余更新。
- 《OpenAI 模型更新日志(2026 持续更新)》:全模型时间线,Astra 条目已同步。
- 《GPT 模型完全指南(2026-07):GPT-5.6 Sol / Terra / Luna 选型》:Terra / Luna 角色保留后的现行选型指南。
关键要点
- 时间线全程可复现:2026-09-03 openai/codex PR #42619 加入 Bedrock 目录;09-04 PR #42879 选择器 visibility=list 且排首位;09-05 PR #42931 捆绑迁移指南由 GPT-5.6 Sol 版替换为 Astra 版;09-09 随 CLI 0.154.0 发布
- Codex 捆绑元数据(models.json,rust-v0.154.0 tag):context_window 272000 / max_context_window 872000(experimental context)、supported_in_api=true、priority=1、minimal_client_version 0.153.0、输入 text+image、tool_mode=code_mode_only
- 推理六档 low/medium/high/xhigh/max/ultra,默认 low;ultra 官方描述为 Maximum reasoning with automatic task delegation(自动任务委托);gpt-6-astra 不支持 none 档
- 官方指南快照四项新能力:async tool calling(工具设 async:true,就绪后按原 call_id 回传)、mid-turn steering(WebSocket 连接上发送中途指令)、configuration_update 输入项(中途改推理档且保住缓存前缀)、misalignment monitoring(异步失准监测告警)
- 迁移清单:工具调用必须走 Responses(Chat Completions 可用但工具调用不行);移除 temperature/top_p/top_logprobs(Chat Completions 另移 logprobs);GPT-5.5 及更早的 prompt_cache_retention 改 prompt_cache_options.ttl 设 30m;none/minimal 用户从 low 起步
- 角色映射官方口径:Sol→Astra(Astra is the flagship-equivalent tier),Terra 与 Luna 保留原角色;per-token 定价高于前代但具体数字不在快照内,截至 2026-09-15 官方文档域对本站 403 无法核对
常见问题
官方参考
- 更新openai/codex CLI 0.154.0 Release Notes(GitHub)
- 文档openai/codex PR #42619:Add GPT-6-Astra to Amazon Bedrock catalogs
- 文档openai/codex PR #42879:List GPT-6-Astra in the model picker
- 文档openai/codex PR #42931:Update OpenAI Docs skill guidance for GPT-6 Astra
- 文档Codex 仓库捆绑的 upgrading-to-gpt-6-astra.md 官方指南快照(rust-v0.154.0 tag)
- 文档Codex 仓库捆绑模型元数据 models.json(rust-v0.154.0 tag)
相关文章
gpt-6-astra 现身 OpenAI SDK:ChatModel 枚举新模型 ID 与 Safety Alerts API 解读
2026-09-03 发布的 openai-python v3.8.0 与 openai-node v7.10.0 把 gpt-6-astra 写进 ChatModel 类型枚举首位,同批落地 Safety Alerts API 与 misalignment 错误详情。本文只写能在 SDK 源码里指出的东西,发布状态与定价不做断言。
阅读全文reasoning.effort 调参实战:把推理深度变成可调参数
同一个模型,推理深度可以按请求调节。本文讲清 reasoning.effort 的写法、各档位的适用场景、与 max_output_tokens 的配合,以及 effort 调错带来的成本与质量后果。
阅读全文GPT-5.6 vs Claude 4.5 Sonnet vs Gemini 2.5 Pro:三大模型实战对比(2026-08)
GPT-5.6 / Claude 4.5 Sonnet / Gemini 2.5 Pro 三家旗舰模型实战对比:编码 / 多模态 / 长上下文 / 长推理 / 工具调用 / 价格。第三方 benchmark + 真实场景测试。多模型选型决策表。
阅读全文订阅 GPTMap Weekly
每周一封邮件,精选 OpenAI 重要更新、深度解读与最佳实践。无广告,可随时退订。
提交后将在新标签页打开 Buttondown 完成订阅确认。