Appearance
GPT-5.6 Sol、Terra、Luna 怎么选?
你会学到:先分清模型档位、推理强度和 Ultra,再按任务难度、可验收程度与成本选择 Sol、Terra 或 Luna。
官方信息复核:2026-08-12 这页只保留 OpenAI 官方模型文档当前可核验的内容。你实际能看到哪些模型和档位,仍以当前产品、账号与组织设置为准。
先看结论
| 模型 | 官方定位 | 适合先试的任务 |
|---|---|---|
| GPT-5.6 Sol | 旗舰能力,面向复杂专业工作 | 模糊、困难、高价值、需要判断与精修的任务 |
| GPT-5.6 Terra | 在能力与成本之间平衡 | 日常编码、文档、研究和工具调用 |
| GPT-5.6 Luna | 面向成本敏感的高吞吐工作 | 规则明确、可批量验收的抽取、分类、转换和摘要 |
如果不确定,官方 Codex 模型指南建议从 Sol 开始;当任务边界清晰、验收稳定后,再测试 Terra 或 Luna 是否能以更低成本达到相同完成标准。
text
任务模糊、失败代价高 → Sol
日常工作、范围已明确 → Terra
规则固定、可以批量验收 → Luna不要把 4 个概念混在一起
1. 模型档位
Sol、Terra、Luna 是 GPT-5.6 家族的三档模型。gpt-5.6 这个 API 别名会路由到 gpt-5.6-sol。
2. 推理强度
推理强度是让同一个模型投入多少推理工作,不是另一个模型。GPT-5.6 API 模型页当前列出 none、low、medium(默认)、high、xhigh 和 max。产品界面可能用 Light、Extra High 等更易读的标签。
官方建议先从默认档位开始;只有任务需要更深的计划、分析或检查时再提高。更高档位通常更慢,也会使用更多 token。
3. Pro mode
API 的 Pro mode 用 reasoning.mode: "pro" 开启。它让 GPT-5.6 为困难任务投入更多模型工作并返回一个最终答案,适合质量比延迟和 token 使用更重要的场景。它也不是第四档模型。
4. Max 和 Ultra
Max 是单个所选模型的更高推理投入。Ultra 则会用 subagent 并行处理可拆分的复杂任务。多数任务不需要 Max 或 Ultra;如果任务不能拆成有意义的独立部分,Ultra 不会自动让结果更好。
在 Codex 里切换
在交互式 CLI 会话中可以使用 /model。启动 Codex 或执行非交互任务时,可以用 --model 或 -m:
bash
codex --model gpt-5.6
codex exec -m gpt-5.6 "Review the current changes"也可以显式选择三档模型:
bash
codex -m gpt-5.6-sol
codex -m gpt-5.6-terra
codex -m gpt-5.6-luna模型选择器里实际出现的选项可能受产品入口、账号和管理员策略影响。看不到某一档时,先查当前官方模型页,不要把它直接判断为安装失败。
API 规格与标准文本 token 价格
下表按各模型详情页在 2026-08-12 显示的每 100 万文本 token 价格记录,单位为美元:
| 模型 | 输入 | 缓存输入 | 输出 | 上下文 | 最大输出 |
|---|---|---|---|---|---|
gpt-5.6-sol | $5.00 | $0.50 | $30.00 | 1,050,000 | 128,000 |
gpt-5.6-terra | $2.00 | $0.20 | $12.00 | 1,050,000 | 128,000 |
gpt-5.6-luna | $0.20 | $0.02 | $1.20 | 1,050,000 | 128,000 |
gpt-5.5 | $5.00 | $0.50 | $30.00 | 1,050,000 | 128,000 |
价格页还标明:GPT-5.6 请求输入超过 272K token 时,整次请求按 2 倍输入、1.5 倍输出计价;cache write 为未缓存输入费率的 1.25 倍。Batch、区域处理、工具调用等可能采用其他口径。API 费用也不等于 ChatGPT 订阅或产品内 credits。
价格、模型可用性和计费规则都可能变化。准备采购、迁移或对外引用时,请重新打开下面的模型详情页。
从 GPT-5.5 迁移
OpenAI 的模型指南建议:先沿用当前 GPT-5.5 的推理设置,再用代表性任务测试同一档和低一档。GPT-5.6 可能用更少 token 达到同等或更高质量,但最佳设置取决于你的工作负载。
本站建议用一个小型回归集做决定:
- 选 10–30 个真实任务,固定 prompt、工具权限和验收标准。
- 日常任务先对比 GPT-5.5 与 Terra;高难任务再加入 Sol。
- 规则明确的批量任务单独测试 Luna。
- 记录一次通过率、总耗时、token、重试和人工返工时间。
- 只有质量不下降或总成本更优时,才修改默认模型,并保留短期回退。
这 5 步是本站的实施建议,不是 OpenAI 对效果的保证。
常见误区
- 把 Sol、Terra、Luna、推理强度、Pro、Max 和 Ultra 当成同一条刻度。
- 为简单任务默认使用最高推理档,而不看耗时和验收结果。
- 只比较 token 单价,不统计重试、返工和人工检查。
- 一次性迁移所有生产流程,不保留 GPT-5.5 基线。
- 把某个账号看不到模型,写成所有用户都不可用。
完成标准
- 你能用一句话区分 Sol、Terra 和 Luna。
- 你知道推理强度、Pro、Max、Ultra 都不是第四个模型。
- 你会用真实任务与验收指标决定迁移,而不是只看 benchmark。
- 你知道价格和可用性必须回官方页面复核。
推荐下一步
- 还没开始实操:做第一次安全练习。
- 准备检查结果:读怎么看 diff 和验证。
- 准备沉淀规则:打开AGENTS.md 生成器。