Claude Sonnet 5 API 指南:价格、开通与接入(2026)
Claude Sonnet 5 于 2026 年 6 月 30 日发布。本文拆解真实 API 定价(引导价 + tokenizer 陷阱)、模型 ID,以及两种调用方式。

核心要点
- Claude Sonnet 5(模型 ID
claude-sonnet-5)于 2026 年 6 月 30 日发布——Anthropic 的中端 agentic 模型,以几分之一的价格逼近 Opus 4.8 质量,1M 上下文、128K 输出 - API 引导价 $2 / $10 每 1M 输入/输出,到 2026 年 8 月 31 日,之后 $3 / $15——便宜价有到期日
- "成本中性"背后的坑:Sonnet 5 换了新 tokenizer,同样的文本最多多算 35% 的 token,所以即便单价和 Sonnet 4.6 相同,你的实际账单也可能上涨
- 你可以直连 Anthropic,也可以用 Velokey 的 OpenAI 兼容端点、一个 key 调用,$3 / $15 积分计费
Anthropic 把 Claude Sonnet 5 宣传成"成本中性"升级——和 Sonnet 4.6 同样的每 token 单价、更好的模型。这对价目表上的费率是真的,对你实际付的账单却有误导,因为 Sonnet 5 还改了 token 的计数方式。下面讲清楚这个 API 到底多少钱、模型 ID 和规格,以及两种调用方式——包括省掉配置的那一种。

Claude Sonnet 5 是什么?
Claude Sonnet 5 是 Anthropic 的中端模型,2026 年 6 月 30 日发布,为规划、工具调用和自主编码而做,价格低于 Opus 档。它在很多 agentic 任务上逼近 Opus 4.8 质量,成本却只有几分之一。
API 模型 ID 是 claude-sonnet-5。它有 100 万 token 上下文窗口(既是默认也是上限),最多 128K 输出 token,支持完整的现代特性:高清视觉(最高 2576px)、工具调用、提示词缓存、JSON schema 结构化输出、web search、computer use,以及最高 xhigh 的 effort 档。Anthropic 还称它在 agentic 场景下比 Sonnet 4.6 更安全。
Claude Sonnet 5 一览:
| 规格 | 详情 |
|---|---|
| 模型 ID | claude-sonnet-5 |
| 发布 | 2026-06-30 |
| 上下文窗口 | 100 万 token(默认 & 上限) |
| 最大输出 | 128K token |
| 视觉 | 高清,最高 2576px |
| 特性 | 工具调用、缓存、结构化输出、web search、computer use、effort(到 xhigh) |
*来源:Anthropic Claude Sonnet 5 发布,2026。*
定位就是重点:当你想要接近 Opus 的 agentic 和编码能力、又要在高频量级下跑而不承担 Opus 档成本时,就用它。
Claude Sonnet 5 API 多少钱?
Claude Sonnet 5 有一个引导价:每 1M 输入 token $2、输出 $10,到 2026 年 8 月 31 日,之后转为标准价 $3 / $15。两个日期都要记:做预算按标准价,别按促销价。
Claude Sonnet 5 API 定价(每 1M token):
| 时期 | 输入 | 输出 |
|---|---|---|
| 引导价(至 2026-08-31) | $2 | $10 |
| 标准价(2026-09-01 起) | $3 | $15 |
*来源:Anthropic 定价,2026。标准价与 Claude Sonnet 4.6 相同。*

下面是多数定价页会略过的部分。Anthropic 把 Sonnet 5 叫"成本中性",因为标准价等于 Sonnet 4.6。但 Sonnet 5 换了新 tokenizer,同样的输入最多多算 35% 的 token。 同一张价目表、每个请求更多的计费 token——所以一个在 Sonnet 4.6 上花你 $X 的负载,在 Sonnet 5 上即便还没改输出长度,也可能明显更贵。
单个请求的成本(还没算 tokenizer 影响):
| 费率 | 1 万输入 + 2 千输出 |
|---|---|
| 引导价 $2 / $10 | $0.04 |
| 标准价 $3 / $15 | $0.06 |
*在 Sonnet 5 的 tokenizer 上给 token 数再加最多约 35%——别默认和旧价平价,先用自己的提示词重新测一遍。*
两个实操动作:在 claude-sonnet-5 上实测真实 token 数(别复用 Sonnet 4.6 的估算),并用好提示词缓存,缓存读取大约按输入价的十分之一计费。想看整条 Claude 线更完整的成本拆解,见我们的 Claude API 定价指南。
怎么调用 Claude Sonnet 5 API?
有两条路。用 anthropic SDK 直连 Anthropic,或用你已有的 key 通过 Velokey 的 OpenAI 兼容端点调 claude-sonnet-5。后者是跑通请求更快的路。
通过 Velokey(OpenAI 兼容,一个 key):
from openai import OpenAI
client = OpenAI(
base_url="https://api.velokey.ai/v1",
api_key="sk-velokey-...", # 你的 Velokey key
)
response = client.chat.completions.create(
model="claude-sonnet-5",
messages=[{"role": "user", "content": "给单体拆微服务写一份迁移方案。"}],
)
print(response.choices[0].message.content)把任意 OpenAI 兼容客户端指向 Velokey 的 base URL,换上 key,设好模型——不用 Anthropic 账户、等级或数据保留配置,$3 / $15 用 Velokey 积分计费。Velokey 用同一个 key 调到 Sonnet 5 和其他所有模型。
直连 Anthropic(Messages API):
import anthropic
client = anthropic.Anthropic() # 读 ANTHROPIC_API_KEY
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=16000,
output_config={"effort": "high"}, # low | medium | high | xhigh
messages=[{"role": "user", "content": "..."}],
)
for block in response.content:
if block.type == "text":
print(block.text)直连给你原生的 Messages API 面(effort、思考、服务端工具)。注意 Sonnet 5 属于较新的 Claude 家族,请求规则和它的同代一致——别传 temperature/top_p 或固定思考预算。如果这些配置比你想要的多,上面那条 OpenAI 兼容路线就省掉了它们。
什么时候用 Claude Sonnet 5、什么时候用 Opus 4.8?
大部分 agentic 和编码活儿用 Sonnet 5——规划、工具调用、自主编码——你想要接近 Opus 的质量、成本却只有它的一半到三分之一。把 Opus 4.8(或 Fable 5)留给真正需要顶档的最难推理和最长链路任务。
- Sonnet 5——生产 agent、编码助手、高频工具调用,以及任何对成本敏感又需要强推理的场景。标准价 $3 / $15。
- Opus 4.8——那一小撮质量差距值回价差($5 / $25)的难任务。
- Fable 5——最苛刻工作的前沿天花板($10 / $50)。见我们的 Claude Fable 5 API 指南。
多数团队把 Sonnet 5 当默认、按需升级——和你在 GPT-5.6 三档决策 里权衡的是同一套逻辑。
常见问题
Claude Sonnet 5 API 多少钱?
引导价每 1M 输入 token $2、输出 $10,到 2026 年 8 月 31 日,之后是标准价 $3 / $15。标准价和 Sonnet 4.6 相同,但 Sonnet 5 的新 tokenizer 对同样输入最多多算 35% token——所以要实测真实用量,别默认沿用 Sonnet 4.6 的成本。
Claude Sonnet 5 的模型 ID 是什么?
API 模型 ID 是 claude-sonnet-5——精确字符串,不带日期后缀。它有 100 万 token 上下文窗口、最多 128K 输出 token,支持工具调用、视觉、提示词缓存、结构化输出、web search,以及最高 xhigh 的 effort 档。
Claude Sonnet 5 有 Opus 4.8 好吗?
在很多 agentic 和编码任务上,它以几分之一的价格逼近 Opus 4.8 质量。大部分生产活儿 Sonnet 5 是合理默认;把 Opus 4.8 或 Fable 5 留给顶档值回价差的最难推理和最长链路任务。
为什么单价没涨、账单却涨了,还叫"成本中性"?
因为每 token 单价等于 Sonnet 4.6。账单仍可能上涨,是因为 Sonnet 5 用了新 tokenizer,同样的文本最多多算 35% token——同样费率、更多计费 token。在 claude-sonnet-5 上重新测 token 数,别默认成本不变。
没有 Anthropic 账户怎么用 Claude Sonnet 5?
通过统一 API 网关调用。把 OpenAI 兼容客户端指向 Velokey 端点(https://api.velokey.ai/v1),用你的 Velokey key,模型设成 claude-sonnet-5——不用 Anthropic 账户、等级或数据保留配置,$3 / $15 用积分计费。
想用 Claude Sonnet 5 又不想折腾 Anthropic 配置? [领取 Velokey API 密钥](/model/claude-sonnet-5),用一个兼容 OpenAI 的端点调 claude-sonnet-5——同一个密钥,和你用的其他所有模型一起。
*最后更新:2026 年 7 月 13 日。价格与规格来自 Anthropic 的 Claude Sonnet 5 发布。引导价和 tokenizer 行为由 Anthropic 设定、可能变动——投入生产预算前请核实当前数字。*


