Claude Sonnet 5 API: Preise, Zugang & Einrichtung (2026)
Claude Sonnet 5 wurde am 30. Juni 2026 veröffentlicht. Hier sind die echten API-Preise (Einführungspreis + der Tokenizer-Haken), die Modell-ID und wie man sie auf zwei Arten aufruft.

TL;DR
- Claude Sonnet 5 (Modell-ID
claude-sonnet-5) wurde am 30. Juni 2026 veröffentlicht — Anthropics Mid-Tier-Agentenmodell, nahe Opus-4.8-Qualität zu einem Bruchteil des Preises, mit 1M-Token-Kontextfenster und 128K max. Output - Einführungs-API-Preise: $2 / $10 pro 1M Input-/Output-Tokens bis 31. August 2026, danach $3 / $15 — der günstige Tarif hat also ein Ablaufdatum
- Der Haken hinter dem Framing „kostenneutral“: Sonnet 5 liefert einen neuen Tokenizer, der für denselben Text bis zu 35 % mehr Tokens zählen kann — die effektive Rechnung kann also steigen, obwohl der Token-Preis dem von Sonnet 4.6 entspricht
- Aufruf direkt über Anthropic oder über den OpenAI-kompatiblen Endpoint von Velokey mit einem Key zu $3 / $15 über Credits
Anthropic hat Claude Sonnet 5 als „kostenneutrales“ Upgrade positioniert — gleicher Token-Preis wie Sonnet 4.6, besseres Modell. Das gilt für den Tarif auf dem Preisblatt und ist irreführend für die Rechnung, die man tatsächlich zahlt, weil Sonnet 5 auch die Token-Zählung geändert hat. Hier, was die API wirklich kostet, die Modell-ID und Specs sowie die zwei Wege zum Aufruf — inklusive dem, der das Setup überspringt.

Was ist Claude Sonnet 5?
Claude Sonnet 5 ist Anthropics Mid-Tier-Modell, veröffentlicht am 30. Juni 2026, gebaut für Planung, Tool Use und autonomes Coding zu einem niedrigeren Preis als die Opus-Stufe. Es erreicht bei vielen agentischen Aufgaben Opus-4.8-Qualität und kostet dabei nur einen Bruchteil.
Die API-Modell-ID lautet claude-sonnet-5. Es bietet ein 1M-Token-Kontextfenster (Standard und Maximum) und bis zu 128K Output-Tokens und unterstützt den vollen modernen Feature-Satz: hochauflösende Vision (bis 2576px), Tool Use, Prompt Caching, Structured Outputs mit JSON Schema, Web Search, Computer Use und Effort-Level bis xhigh. Anthropic berichtet außerdem, dass es sich in agentischen Kontexten sicherer verhält als Sonnet 4.6.
Claude Sonnet 5 auf einen Blick:
| Spec | Detail |
|---|---|
| Model ID | claude-sonnet-5 |
| Released | June 30, 2026 |
| Context window | 1M tokens (default & max) |
| Max output | 128K tokens |
| Vision | High-res, up to 2576px |
| Features | Tool use, caching, structured outputs, web search, computer use, effort (to xhigh) |
*Quelle: Anthropic Claude-Sonnet-5-Ankündigung, 2026.*
Die Positionierung ist der Punkt: Es ist das Modell, das man greift, wenn man agentische und Coding-Fähigkeit nahe an Opus will, aber in Volumen ohne Opus-Kosten fahren muss.
Wie viel kostet die Claude Sonnet 5 API?
Claude Sonnet 5 hat einen Einführungspreis von $2 pro 1M Input-Tokens und $10 pro 1M Output bis 31. August 2026, danach gilt der Standardtarif $3 / $15. Beide Daten zählen: Budget auf dem Standardtarif planen, nicht auf der Promo.
Claude Sonnet 5 API-Preise (pro 1M Tokens):
| Period | Input | Output |
|---|---|---|
| Intro (through Aug 31, 2026) | $2 | $10 |
| Standard (from Sep 1, 2026) | $3 | $15 |
*Quelle: Anthropic Pricing, 2026. Der Standardtarif entspricht Claude Sonnet 4.6.*

Hier der Teil, den die meisten Pricing-Seiten auslassen. Anthropic nennt Sonnet 5 „kostenneutral“, weil der Standardtarif dem von Sonnet 4.6 entspricht. Aber Sonnet 5 liefert einen neuen Tokenizer, der für exakt denselben Input bis zu 35 % mehr Tokens zählen kann. Gleiche Preisliste, mehr abrechenbare Tokens pro Request — ein Workload, der auf Sonnet 4.6 $X gekostet hat, kann auf Sonnet 5 spürbar teurer werden, noch bevor die Output-Länge ins Spiel kommt.
Was ein Request kostet (vor dem Tokenizer-Effekt):
| Rate | 10K in + 2K out |
|---|---|
| Intro $2 / $10 | $0.04 |
| Standard $3 / $15 | $0.06 |
*Rechne auf Sonnet 5s Tokenizer bis zu ~35 % mehr Token-Counts — baseliere deine eigenen Prompts neu, bevor du Parität annimmst.*
Zwei praktische Schritte: echte Token-Counts auf claude-sonnet-5 messen (Sonnet-4.6-Schätzungen nicht wiederverwenden) und Prompt Caching nutzen, wo gecachte Reads mit etwa einem Zehntel des Input-Tarifs abgerechnet werden. Für eine ausführlichere Kostenübersicht über die Claude-Linie siehe unseren Claude-API-Preisleitfaden.
Wie ruft man die Claude Sonnet 5 API auf?
Es gibt zwei Wege. Anthropic direkt mit dem anthropic-SDK aufrufen, oder claude-sonnet-5 über Velokeys OpenAI-kompatiblen Endpoint mit einem Key, den man bereits hat. Der zweite ist der schnellere Weg zu einem funktionierenden Request.
Über Velokey (OpenAI-kompatibel, ein Key):
from openai import OpenAI
client = OpenAI(
base_url="https://api.velokey.ai/v1",
api_key="sk-velokey-...", # your Velokey key
)
response = client.chat.completions.create(
model="claude-sonnet-5",
messages=[{"role": "user", "content": "Draft a migration plan for moving a monolith to services."}],
)
print(response.choices[0].message.content)Jeden OpenAI-kompatiblen Client auf die Velokey-Base-URL zeigen, den Key tauschen und das Modell setzen — kein Anthropic-Account, kein Tier, kein Data-Retention-Setup, zu $3 / $15 abgerechnet über Velokey-Credits. Velokey erreicht Sonnet 5 neben jedem anderen Modell mit demselben Key.
Direkt über Anthropic (Messages API):
import anthropic
client = anthropic.Anthropic() # reads ANTHROPIC_API_KEY
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=16000,
output_config={"effort": "high"}, # low | medium | high | xhigh
messages=[{"role": "user", "content": "..."}],
)
for block in response.content:
if block.type == "text":
print(block.text)Der direkte Weg gibt die native Messages-API-Oberfläche (effort, Thinking, serverseitige Tools). Sonnet 5 sitzt in der neueren Claude-Familie, daher gelten dieselben Request-Regeln wie bei den Geschwistern — kein temperature/top_p und kein fixes Thinking-Budget übergeben. Wenn das mehr Setup ist als gewünscht, spart der OpenAI-kompatible Weg oben das ein.
Wann sollte man Claude Sonnet 5 statt Opus 4.8 nutzen?
Sonnet 5 für den Großteil agentischer und Coding-Arbeit nutzen — Planung, Tool Use, autonomes Coding —, wo man nahe Opus-Qualität zu etwa der Hälfte bis einem Drittel der Kosten will. Opus 4.8 (oder Fable 5) für die härtesten Reasoning- und Long-Horizon-Aufgaben reservieren, die wirklich die Top-Stufe brauchen.
- Sonnet 5 — Produktions-Agents, Coding-Assistenten, High-Volume-Tool-Calling, alles Kostensensitive, das trotzdem starkes Reasoning braucht. $3 / $15 Standard.
- Opus 4.8 — die schwierige Minderheit der Aufgaben, bei der die Qualitätslücke die Preislücke rechtfertigt ($5 / $25).
- Fable 5 — die Frontier-Decke für die anspruchsvollste Arbeit ($10 / $50). Siehe unseren Claude-Fable-5-API-Leitfaden.
Die meisten Teams fahren Sonnet 5 als Default und eskalieren selektiv — dasselbe Muster wie bei einer GPT-5.6-Tier-Entscheidung.
Häufig gestellte Fragen
Wie viel kostet die Claude Sonnet 5 API?
Einführungspreise: $2 pro 1M Input-Tokens und $10 pro 1M Output bis 31. August 2026, danach der Standardtarif $3 / $15. Der Standardtarif entspricht Sonnet 4.6, aber der neue Tokenizer von Sonnet 5 kann für denselben Input bis zu 35 % mehr Tokens zählen — also echten Verbrauch messen, statt anzunehmen, dass Sonnet-4.6-Kosten übertragbar sind.
Was ist die Claude-Sonnet-5-Modell-ID?
Die API-Modell-ID lautet claude-sonnet-5 — der exakte String, ohne Datums-Suffix. Sie hat ein 1M-Token-Kontextfenster und bis zu 128K Output-Tokens und unterstützt Tool Use, Vision, Prompt Caching, Structured Outputs, Web Search und Effort-Level bis xhigh.
Ist Claude Sonnet 5 so gut wie Opus 4.8?
Es erreicht bei vielen agentischen und Coding-Aufgaben Opus-4.8-Qualität zu einem Bruchteil des Preises. Für den Großteil der Produktionsarbeit ist Sonnet 5 der sinnvolle Default; Opus 4.8 oder Fable 5 für die härtesten Reasoning- und Long-Horizon-Aufgaben reservieren, bei denen die Top-Stufe den Preisaufschlag verdient.
Warum heißt Claude Sonnet 5 „kostenneutral“, wenn meine Rechnung gestiegen ist?
Weil der Token-Preis dem von Sonnet 4.6 entspricht. Die Rechnung kann trotzdem steigen, weil Sonnet 5 einen neuen Tokenizer nutzt, der für denselben Text bis zu 35 % mehr Tokens zählt — gleicher Tarif, mehr abrechenbare Tokens. Token-Counts auf claude-sonnet-5 neu baselinen, bevor man annimmt, dass die Kosten unverändert sind.
Wie nutze ich Claude Sonnet 5 ohne Anthropic-Account?
Über ein Unified-API-Gateway aufrufen. Einen OpenAI-kompatiblen Client auf Velokeys Endpoint (https://api.velokey.ai/v1) zeigen, den Velokey-Key verwenden und das Modell auf claude-sonnet-5 setzen — kein Anthropic-Account, kein Tier, kein Data-Retention-Setup, abgerechnet zu $3 / $15 über Credits.
Claude Sonnet 5 ohne Anthropic-Setup? [Hol dir deinen Velokey-API-Key](/model/claude-sonnet-5) und rufe claude-sonnet-5 über einen OpenAI-kompatiblen Endpoint auf — derselbe Key, neben jedem anderen Modell, das du nutzt.
*Zuletzt aktualisiert: 13. Juli 2026. Preise und Specs stammen aus Anthropics Claude-Sonnet-5-Launch. Einführungspreis und Tokenizer-Verhalten werden von Anthropic festgelegt und können sich ändern — aktuelle Zahlen vor Produktionsbudgets verifizieren.*


