GPT-5.6 Sol vs Terra vs Luna:三档怎么选(2026)
GPT-5.6 分 Sol、Terra、Luna 三档。本文拆解各档价格、基准与适用场景,教你按 API 负载选对那一档。

核心要点
- GPT-5.6 于 2026 年 7 月 9 日 GA,分三档:Sol(旗舰)、Terra(均衡默认)、Luna(最便宜最快)
- 每 1M token:Sol $5/$30、Terra $2.50/$15、Luna $1/$6——从顶到底 5 倍价差
- 基准分差远小于价差:Terra 在多数测试上跟 Sol 只差约 2 分、价格却只有一半,所以多数活儿默认用 Terra
- 只有最难的 agentic / 长链路任务才上 Sol;高量短文用 Luna——但别用 Luna 做长上下文(它的召回会崩)
OpenAI 这次没发一个 GPT-5.6,发了三个——Sol、Terra、Luna——价格从顶到底差 5 倍。调 API 的人第一个问题就是:你真需要旗舰,还是便宜那档就够?老实说,基准分差比价差窄得多,所以多数负载不该默认上 Sol。这篇按档拆价格对性能,外加便宜那档唯一真会翻车的地方。

GPT-5.6 Sol、Terra、Luna 是什么?
GPT-5.6 Sol、Terra、Luna 是同一模型家族的三档,2026 年 7 月 9 日一起发布,用能力换成本。Sol 是旗舰,Terra 是均衡的日常档,Luna 是成本与速度担当。
它们是同一代——Programmatic Tool Calling(模型写 JS、在隔离的无网络 V8 沙箱里跑)和新的可预测缓存,三档都有。档之间变的是原始能力、延迟和价格。三档现在都能通过 OpenAI API、ChatGPT、Codex 和 GitHub Copilot 用到。
GPT-5.6 三档一览:
| 档 | API 模型 ID | 价格 /1M(输入/输出) | 最适合 |
|---|---|---|---|
| Sol | gpt-5.6-sol | $5 / $30 | 最难的 agentic + 长链路 |
| Terra | gpt-5.6-terra | $2.50 / $15 | 多数生产任务的默认 |
| Luna | gpt-5.6-luna | $1 / $6 | 高量、延迟敏感、短上下文 |
*来源:OpenAI GPT-5.6 发布,2026-07-09。gpt-5.6 是别名,指向旗舰。*
OpenAI 那句"随你野心扩展的智能",翻译过来就是:选能过你任务门槛的最小那档,非必要不加价。
每档 GPT-5.6 多少钱?
每 1M token,Sol $5 输入 / $30 输出,Terra $2.50 / $15,Luna $1 / $6。每降一档价格砍一半,Sol 到 Luna 一共差 5 倍。
Token 价格空谈没感觉,套到真实负载才清楚。拿一个中等生产应用,每月 1000 万输入 + 200 万输出 token:
1000 万输入 / 200 万输出 的月成本:
| 档 | 输入 | 输出 | 月合计 |
|---|---|---|---|
| Sol | $50 | $60 | $110 |
| Terra | $25 | $30 | $55 |
| Luna | $10 | $12 | $22 |
*基于公开每 token 费率的示意计算;你的输入/输出比例会改变合计。*

同样的活,账单差 5 倍。这个差距就是"路由到哪档"值得较真的全部理由——也是为什么把每个请求都默认发给 Sol,是团队在这个家族上最常见的多花钱方式。
GPT-5.6 三档基准怎么比?
多数基准上,三档聚得比价格暗示的近得多——Terra 通常跟 Sol 只差约 2 分,Luna 再多差几分。唯一例外是长上下文召回,Luna 在那里断崖。
家族公开数据如下:
GPT-5.6 基准对比:
| 基准 | Sol | Terra | Luna |
|---|---|---|---|
| Terminal-Bench 2.1 | 88.8% | 87.4% | 84.7% |
| Agents' Last Exam | 53.6 | 50.4 | 50.3 |
| 编码 Agent 指数(Artificial Analysis) | 80 | 77.4 | 74.6 |
| MRCR 长上下文召回 | 91.5% | 89.6% | 41.3% |
*来源:GPT-5.6 公开基准表,2026(Vellum、OpenAI)。Sol 另在 BrowseComp 上 92.2%;Sol Ultra 在 Terminal-Bench 2.1 上 91.9%。*
两点很跳眼。第一,编码和 agentic 任务上三档很近——Luna 用五分之一的价保住约 85% 的 Sol 质量,对高量活儿是极好的交易。第二,MRCR 长上下文召回是便宜档翻车的地方:Luna 掉到 41.3%,而 Sol 和 Terra 还在 90% 附近。如果你的负载要喂长文档或大上下文,Luna 不管多便宜都出局。
每档 GPT-5.6 什么时候用?
默认 Terra,只有最难的 agentic 才上 Sol,高量短文降到 Luna。别按名气选档——按任务真正的需求选。
- Terra——默认。 多数基准上跟 Sol 只差约 2 分,价格却是一半。多数生产应用、聊天、编码辅助、一般 agent 步骤,Terra 都是正确的起点。只有当某个具体任务证明 Terra 不够,才换别的。
- Sol——硬骨头。 长链路多步工作流、复杂终端操作、网络安全研究、computer use,以及任何需要 max reasoning 或 ultra 模式的场景。Sol 是唯一完整支持前沿特性的档,也领跑每项基准——只是领先幅度不足以让你处处都用它。
- Luna——要量不要深。 高吞吐、延迟敏感、每次查询成本比最后几分推理更重要的流水线:分类、打标、路由、短摘要、批量生成。别让它碰长上下文。
多数团队最后落到的实际做法不是"选一个",而是路由:大部分调用走 Luna 或 Terra,Sol 只留给真正需要它的步骤。混档配置的价值,就在这里回本。
怎么在 API 里切换 GPT-5.6 三档?
切档就是改模型 ID——gpt-5.6-sol、gpt-5.6-terra 或 gpt-5.6-luna——请求其余部分完全不变。三档共用一套接口,所以按任务路由是改一个字段的事。
from openai import OpenAI
client = OpenAI(api_key="sk-...") # 用环境变量,别硬编码
def answer(prompt, hard=False, bulk=False):
# 按任务路由:默认便宜,非必要不升级
model = "gpt-5.6-sol" if hard else "gpt-5.6-luna" if bulk else "gpt-5.6-terra"
return client.chat.completions.create(
model=model,
messages=[{"role": "user", "content": prompt}],
)直连的坑在于:这套路由写死在你代码里、绑死一家的档位。以后你想把部分流量发给更便宜的非 OpenAI 模型、或某档被限流时兜底,就得重写。像 Velokey 这样的统一网关把 Sol、Terra、Luna 和其他厂商的模型放在一个兼容 OpenAI 的端点后面,于是切档路由和跨模型兜底变成配置、而不是重写——这恰恰是"把负载拆到不同档以控成本"的意义所在。
发布来龙去脉见我们的 GPT-5.6 发布报道;跟其他前沿模型的横评,可看 GLM-5.2 vs GPT-5.5 vs Claude Opus 4.8 拆解 和 Claude API 定价指南。
常见问题
GPT-5.6 默认该用哪档?
Terra。它在多数基准上跟 Sol 只差约 2 分,价格却是一半($2.50/$15 对 $5/$30 每 1M token)。生产负载从 Terra 起步,只有可量化地证明需要更多时才升到 Sol——长链路 agent、复杂终端操作、或 max reasoning 模式。
Sol、Terra、Luna 差价多少?
每 1M token:Sol $5 输入 / $30 输出,Terra $2.50 / $15,Luna $1 / $6。每降一档砍一半,Sol 到 Luna 差 5 倍。按每月 1000 万输入/200 万输出算,大约 $110(Sol)对 $22(Luna)。
GPT-5.6 Luna 够不够生产用?
高量短上下文任务够——Luna 用五分之一的价保住约 85% 的 Sol 质量。但它的长上下文召回掉到 41.3%(Sol 和 Terra 约 90%),所以别拿 Luna 做长文档或大上下文。它适合分类、打标、路由、批量生成。
GPT-5.6 的 API 模型 ID 是什么?
gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna。裸的 gpt-5.6 别名指向旗舰(Sol)。切档是请求里改一个字段的事,因为三档共用同一套 API 接口。
Sol 什么时候值 Luna 的 5 倍价?
当任务真需要前沿推理:长链路多步 agent、复杂终端操作、网络安全研究、computer use,或 Luna 召回会失败的长上下文。日常聊天、编码辅助、常规 agent 步骤,Sol 相对 Terra 或 Luna 的提升很少值那个价。
一个应用里能混用 GPT-5.6 三档吗?
能,而且最省钱的做法都这么干。大部分调用发 Luna 或 Terra,Sol 只留给最难的步骤。三档共用一套接口,可以按请求选模型。统一网关能把这种路由(以及切到其他模型兜底)变成改配置、而不是改代码。
想在 GPT-5.6 三档间路由、又不想绑死一家? 领取 Velokey API 密钥,用一个兼容 OpenAI 的端点调 Sol、Terra、Luna——以及其他厂商的模型,支持按请求选模型和自动兜底。
*最后更新:2026 年 7 月 10 日。价格与基准数据来自撰写时 OpenAI 的 GPT-5.6 发布及公开评测表。数字由 OpenAI 设定、可能变动——投入生产预算前请核实当前费率与基准。*

