Velokey
使用教程

Claude Sonnet 5 API 指南:价格、开通与接入(2026)

Claude Sonnet 5 于 2026 年 6 月 30 日发布。本文拆解真实 API 定价(引导价 + tokenizer 陷阱)、模型 ID,以及两种调用方式。

Claude Sonnet 5 API 指南:价格、开通与接入(2026)

核心要点

  • Claude Sonnet 5(模型 ID claude-sonnet-5)于 2026 年 6 月 30 日发布——Anthropic 的中端 agentic 模型,以几分之一的价格逼近 Opus 4.8 质量,1M 上下文、128K 输出
  • API 引导价 $2 / $10 每 1M 输入/输出,到 2026 年 8 月 31 日,之后 $3 / $15——便宜价有到期日
  • "成本中性"背后的坑:Sonnet 5 换了新 tokenizer,同样的文本最多多算 35% 的 token,所以即便单价和 Sonnet 4.6 相同,你的实际账单也可能上涨
  • 你可以直连 Anthropic,也可以用 Velokey 的 OpenAI 兼容端点、一个 key 调用,$3 / $15 积分计费

Anthropic 把 Claude Sonnet 5 宣传成"成本中性"升级——和 Sonnet 4.6 同样的每 token 单价、更好的模型。这对价目表上的费率是真的,对你实际付的账单却有误导,因为 Sonnet 5 还改了 token 的计数方式。下面讲清楚这个 API 到底多少钱、模型 ID 和规格,以及两种调用方式——包括省掉配置的那一种。

Claude Sonnet 5 API 价格与接入指南
Claude Sonnet 5:中端 agentic 模型、引导价,以及一个改变算账方式的 tokenizer

Claude Sonnet 5 是什么?

Claude Sonnet 5 是 Anthropic 的中端模型,2026 年 6 月 30 日发布,为规划、工具调用和自主编码而做,价格低于 Opus 档。它在很多 agentic 任务上逼近 Opus 4.8 质量,成本却只有几分之一。

API 模型 ID 是 claude-sonnet-5。它有 100 万 token 上下文窗口(既是默认也是上限),最多 128K 输出 token,支持完整的现代特性:高清视觉(最高 2576px)、工具调用、提示词缓存、JSON schema 结构化输出、web search、computer use,以及最高 xhigh 的 effort 档。Anthropic 还称它在 agentic 场景下比 Sonnet 4.6 更安全。

Claude Sonnet 5 一览:

规格详情
模型 IDclaude-sonnet-5
发布2026-06-30
上下文窗口100 万 token(默认 & 上限)
最大输出128K token
视觉高清,最高 2576px
特性工具调用、缓存、结构化输出、web search、computer use、effort(到 xhigh

*来源:Anthropic Claude Sonnet 5 发布,2026。*

定位就是重点:当你想要接近 Opus 的 agentic 和编码能力、又要在高频量级下跑而不承担 Opus 档成本时,就用它。

Claude Sonnet 5 API 多少钱?

Claude Sonnet 5 有一个引导价:每 1M 输入 token $2、输出 $10,到 2026 年 8 月 31 日,之后转为标准价 $3 / $15。两个日期都要记:做预算按标准价,别按促销价。

Claude Sonnet 5 API 定价(每 1M token):

时期输入输出
引导价(至 2026-08-31)$2$10
标准价(2026-09-01 起)$3$15

*来源:Anthropic 定价,2026。标准价与 Claude Sonnet 4.6 相同。*

Claude Sonnet 5 API 价格:引导价 vs 标准价
Claude Sonnet 5 引导价 $2/$10 到 8 月 31 日,之后 $3/$15

下面是多数定价页会略过的部分。Anthropic 把 Sonnet 5 叫"成本中性",因为标准价等于 Sonnet 4.6。但 Sonnet 5 换了新 tokenizer,同样的输入最多多算 35% 的 token。 同一张价目表、每个请求更多的计费 token——所以一个在 Sonnet 4.6 上花你 $X 的负载,在 Sonnet 5 上即便还没改输出长度,也可能明显更贵。

单个请求的成本(还没算 tokenizer 影响):

费率1 万输入 + 2 千输出
引导价 $2 / $10$0.04
标准价 $3 / $15$0.06

*在 Sonnet 5 的 tokenizer 上给 token 数再加最多约 35%——别默认和旧价平价,先用自己的提示词重新测一遍。*

两个实操动作:在 claude-sonnet-5 上实测真实 token 数(别复用 Sonnet 4.6 的估算),并用好提示词缓存,缓存读取大约按输入价的十分之一计费。想看整条 Claude 线更完整的成本拆解,见我们的 Claude API 定价指南

怎么调用 Claude Sonnet 5 API?

有两条路。用 anthropic SDK 直连 Anthropic,或用你已有的 key 通过 Velokey 的 OpenAI 兼容端点调 claude-sonnet-5。后者是跑通请求更快的路。

通过 Velokey(OpenAI 兼容,一个 key):

from openai import OpenAI

client = OpenAI(
    base_url="https://api.velokey.ai/v1",
    api_key="sk-velokey-...",   # 你的 Velokey key
)

response = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user", "content": "给单体拆微服务写一份迁移方案。"}],
)
print(response.choices[0].message.content)

把任意 OpenAI 兼容客户端指向 Velokey 的 base URL,换上 key,设好模型——不用 Anthropic 账户、等级或数据保留配置,$3 / $15 用 Velokey 积分计费。Velokey 用同一个 key 调到 Sonnet 5 和其他所有模型。

直连 Anthropic(Messages API):

import anthropic

client = anthropic.Anthropic()  # 读 ANTHROPIC_API_KEY

response = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=16000,
    output_config={"effort": "high"},   # low | medium | high | xhigh
    messages=[{"role": "user", "content": "..."}],
)
for block in response.content:
    if block.type == "text":
        print(block.text)

直连给你原生的 Messages API 面(effort、思考、服务端工具)。注意 Sonnet 5 属于较新的 Claude 家族,请求规则和它的同代一致——别传 temperature/top_p 或固定思考预算。如果这些配置比你想要的多,上面那条 OpenAI 兼容路线就省掉了它们。

什么时候用 Claude Sonnet 5、什么时候用 Opus 4.8?

大部分 agentic 和编码活儿用 Sonnet 5——规划、工具调用、自主编码——你想要接近 Opus 的质量、成本却只有它的一半到三分之一。把 Opus 4.8(或 Fable 5)留给真正需要顶档的最难推理和最长链路任务。

  • Sonnet 5——生产 agent、编码助手、高频工具调用,以及任何对成本敏感又需要强推理的场景。标准价 $3 / $15。
  • Opus 4.8——那一小撮质量差距值回价差($5 / $25)的难任务。
  • Fable 5——最苛刻工作的前沿天花板($10 / $50)。见我们的 Claude Fable 5 API 指南

多数团队把 Sonnet 5 当默认、按需升级——和你在 GPT-5.6 三档决策 里权衡的是同一套逻辑。

常见问题

Claude Sonnet 5 API 多少钱?

引导价每 1M 输入 token $2、输出 $10,到 2026 年 8 月 31 日,之后是标准价 $3 / $15。标准价和 Sonnet 4.6 相同,但 Sonnet 5 的新 tokenizer 对同样输入最多多算 35% token——所以要实测真实用量,别默认沿用 Sonnet 4.6 的成本。

Claude Sonnet 5 的模型 ID 是什么?

API 模型 ID 是 claude-sonnet-5——精确字符串,不带日期后缀。它有 100 万 token 上下文窗口、最多 128K 输出 token,支持工具调用、视觉、提示词缓存、结构化输出、web search,以及最高 xhigh 的 effort 档。

Claude Sonnet 5 有 Opus 4.8 好吗?

在很多 agentic 和编码任务上,它以几分之一的价格逼近 Opus 4.8 质量。大部分生产活儿 Sonnet 5 是合理默认;把 Opus 4.8 或 Fable 5 留给顶档值回价差的最难推理和最长链路任务。

为什么单价没涨、账单却涨了,还叫"成本中性"?

因为每 token 单价等于 Sonnet 4.6。账单仍可能上涨,是因为 Sonnet 5 用了新 tokenizer,同样的文本最多多算 35% token——同样费率、更多计费 token。在 claude-sonnet-5 上重新测 token 数,别默认成本不变。

没有 Anthropic 账户怎么用 Claude Sonnet 5?

通过统一 API 网关调用。把 OpenAI 兼容客户端指向 Velokey 端点(https://api.velokey.ai/v1),用你的 Velokey key,模型设成 claude-sonnet-5——不用 Anthropic 账户、等级或数据保留配置,$3 / $15 用积分计费。


想用 Claude Sonnet 5 又不想折腾 Anthropic 配置? [领取 Velokey API 密钥](/model/claude-sonnet-5),用一个兼容 OpenAI 的端点调 claude-sonnet-5——同一个密钥,和你用的其他所有模型一起。


*最后更新:2026 年 7 月 13 日。价格与规格来自 Anthropic 的 Claude Sonnet 5 发布。引导价和 tokenizer 行为由 Anthropic 设定、可能变动——投入生产预算前请核实当前数字。*