Velokey
分析测评

GPT-5.6 Sol vs Terra vs Luna:三档怎么选(2026)

GPT-5.6 分 Sol、Terra、Luna 三档。本文拆解各档价格、基准与适用场景,教你按 API 负载选对那一档。

GPT-5.6 Sol vs Terra vs Luna:三档怎么选(2026)

核心要点

  • GPT-5.6 于 2026 年 7 月 9 日 GA,分三档:Sol(旗舰)、Terra(均衡默认)、Luna(最便宜最快)
  • 每 1M token:Sol $5/$30、Terra $2.50/$15、Luna $1/$6——从顶到底 5 倍价差
  • 基准分差远小于价差:Terra 在多数测试上跟 Sol 只差约 2 分、价格却只有一半,所以多数活儿默认用 Terra
  • 只有最难的 agentic / 长链路任务才上 Sol;高量短文用 Luna——但别用 Luna 做长上下文(它的召回会崩)

OpenAI 这次没发一个 GPT-5.6,发了三个——Sol、Terra、Luna——价格从顶到底差 5 倍。调 API 的人第一个问题就是:你真需要旗舰,还是便宜那档就够?老实说,基准分差比价差窄得多,所以多数负载不该默认上 Sol。这篇按档拆价格对性能,外加便宜那档唯一真会翻车的地方。

GPT-5.6 Sol vs Terra vs Luna 对比
GPT-5.6 三档:Sol、Terra、Luna 的价格与性能对比

GPT-5.6 Sol、Terra、Luna 是什么?

GPT-5.6 Sol、Terra、Luna 是同一模型家族的三档,2026 年 7 月 9 日一起发布,用能力换成本。Sol 是旗舰,Terra 是均衡的日常档,Luna 是成本与速度担当。

它们是同一代——Programmatic Tool Calling(模型写 JS、在隔离的无网络 V8 沙箱里跑)和新的可预测缓存,三档都有。档之间变的是原始能力、延迟和价格。三档现在都能通过 OpenAI API、ChatGPT、Codex 和 GitHub Copilot 用到。

GPT-5.6 三档一览:

API 模型 ID价格 /1M(输入/输出)最适合
Solgpt-5.6-sol$5 / $30最难的 agentic + 长链路
Terragpt-5.6-terra$2.50 / $15多数生产任务的默认
Lunagpt-5.6-luna$1 / $6高量、延迟敏感、短上下文

*来源:OpenAI GPT-5.6 发布,2026-07-09。gpt-5.6 是别名,指向旗舰。*

OpenAI 那句"随你野心扩展的智能",翻译过来就是:选能过你任务门槛的最小那档,非必要不加价。

每档 GPT-5.6 多少钱?

每 1M token,Sol $5 输入 / $30 输出,Terra $2.50 / $15,Luna $1 / $6。每降一档价格砍一半,Sol 到 Luna 一共差 5 倍。

Token 价格空谈没感觉,套到真实负载才清楚。拿一个中等生产应用,每月 1000 万输入 + 200 万输出 token:

1000 万输入 / 200 万输出 的月成本:

输入输出月合计
Sol$50$60$110
Terra$25$30$55
Luna$10$12$22

*基于公开每 token 费率的示意计算;你的输入/输出比例会改变合计。*

GPT-5.6 Sol vs Terra vs Luna 价格
GPT-5.6 三档每 1M token 价格,以及一份月账单样例

同样的活,账单差 5 倍。这个差距就是"路由到哪档"值得较真的全部理由——也是为什么把每个请求都默认发给 Sol,是团队在这个家族上最常见的多花钱方式。

GPT-5.6 三档基准怎么比?

多数基准上,三档聚得比价格暗示的近得多——Terra 通常跟 Sol 只差约 2 分,Luna 再多差几分。唯一例外是长上下文召回,Luna 在那里断崖。

家族公开数据如下:

GPT-5.6 基准对比:

基准SolTerraLuna
Terminal-Bench 2.188.8%87.4%84.7%
Agents' Last Exam53.650.450.3
编码 Agent 指数(Artificial Analysis)8077.474.6
MRCR 长上下文召回91.5%89.6%41.3%

*来源:GPT-5.6 公开基准表,2026(Vellum、OpenAI)。Sol 另在 BrowseComp 上 92.2%;Sol Ultra 在 Terminal-Bench 2.1 上 91.9%。*

两点很跳眼。第一,编码和 agentic 任务上三档很近——Luna 用五分之一的价保住约 85% 的 Sol 质量,对高量活儿是极好的交易。第二,MRCR 长上下文召回是便宜档翻车的地方:Luna 掉到 41.3%,而 Sol 和 Terra 还在 90% 附近。如果你的负载要喂长文档或大上下文,Luna 不管多便宜都出局。

每档 GPT-5.6 什么时候用?

默认 Terra,只有最难的 agentic 才上 Sol,高量短文降到 Luna。别按名气选档——按任务真正的需求选。

  • Terra——默认。 多数基准上跟 Sol 只差约 2 分,价格却是一半。多数生产应用、聊天、编码辅助、一般 agent 步骤,Terra 都是正确的起点。只有当某个具体任务证明 Terra 不够,才换别的。
  • Sol——硬骨头。 长链路多步工作流、复杂终端操作、网络安全研究、computer use,以及任何需要 max reasoning 或 ultra 模式的场景。Sol 是唯一完整支持前沿特性的档,也领跑每项基准——只是领先幅度不足以让你处处都用它。
  • Luna——要量不要深。 高吞吐、延迟敏感、每次查询成本比最后几分推理更重要的流水线:分类、打标、路由、短摘要、批量生成。别让它碰长上下文。

多数团队最后落到的实际做法不是"选一个",而是路由:大部分调用走 Luna 或 Terra,Sol 只留给真正需要它的步骤。混档配置的价值,就在这里回本。

怎么在 API 里切换 GPT-5.6 三档?

切档就是改模型 ID——gpt-5.6-solgpt-5.6-terragpt-5.6-luna——请求其余部分完全不变。三档共用一套接口,所以按任务路由是改一个字段的事。

from openai import OpenAI

client = OpenAI(api_key="sk-...")  # 用环境变量,别硬编码

def answer(prompt, hard=False, bulk=False):
    # 按任务路由:默认便宜,非必要不升级
    model = "gpt-5.6-sol" if hard else "gpt-5.6-luna" if bulk else "gpt-5.6-terra"
    return client.chat.completions.create(
        model=model,
        messages=[{"role": "user", "content": prompt}],
    )

直连的坑在于:这套路由写死在你代码里、绑死一家的档位。以后你想把部分流量发给更便宜的非 OpenAI 模型、或某档被限流时兜底,就得重写。像 Velokey 这样的统一网关把 Sol、Terra、Luna 和其他厂商的模型放在一个兼容 OpenAI 的端点后面,于是切档路由和跨模型兜底变成配置、而不是重写——这恰恰是"把负载拆到不同档以控成本"的意义所在。

发布来龙去脉见我们的 GPT-5.6 发布报道;跟其他前沿模型的横评,可看 GLM-5.2 vs GPT-5.5 vs Claude Opus 4.8 拆解Claude API 定价指南

常见问题

GPT-5.6 默认该用哪档?

Terra。它在多数基准上跟 Sol 只差约 2 分,价格却是一半($2.50/$15 对 $5/$30 每 1M token)。生产负载从 Terra 起步,只有可量化地证明需要更多时才升到 Sol——长链路 agent、复杂终端操作、或 max reasoning 模式。

Sol、Terra、Luna 差价多少?

每 1M token:Sol $5 输入 / $30 输出,Terra $2.50 / $15,Luna $1 / $6。每降一档砍一半,Sol 到 Luna 差 5 倍。按每月 1000 万输入/200 万输出算,大约 $110(Sol)对 $22(Luna)。

GPT-5.6 Luna 够不够生产用?

高量短上下文任务够——Luna 用五分之一的价保住约 85% 的 Sol 质量。但它的长上下文召回掉到 41.3%(Sol 和 Terra 约 90%),所以别拿 Luna 做长文档或大上下文。它适合分类、打标、路由、批量生成。

GPT-5.6 的 API 模型 ID 是什么?

gpt-5.6-solgpt-5.6-terragpt-5.6-luna。裸的 gpt-5.6 别名指向旗舰(Sol)。切档是请求里改一个字段的事,因为三档共用同一套 API 接口。

Sol 什么时候值 Luna 的 5 倍价?

当任务真需要前沿推理:长链路多步 agent、复杂终端操作、网络安全研究、computer use,或 Luna 召回会失败的长上下文。日常聊天、编码辅助、常规 agent 步骤,Sol 相对 Terra 或 Luna 的提升很少值那个价。

一个应用里能混用 GPT-5.6 三档吗?

能,而且最省钱的做法都这么干。大部分调用发 Luna 或 Terra,Sol 只留给最难的步骤。三档共用一套接口,可以按请求选模型。统一网关能把这种路由(以及切到其他模型兜底)变成改配置、而不是改代码。


想在 GPT-5.6 三档间路由、又不想绑死一家? 领取 Velokey API 密钥,用一个兼容 OpenAI 的端点调 Sol、Terra、Luna——以及其他厂商的模型,支持按请求选模型和自动兜底。


*最后更新:2026 年 7 月 10 日。价格与基准数据来自撰写时 OpenAI 的 GPT-5.6 发布及公开评测表。数字由 OpenAI 设定、可能变动——投入生产预算前请核实当前费率与基准。*