Velokey
Tutorials

Claude Sonnet 5 API: Preise, Zugang & Einrichtung (2026)

Claude Sonnet 5 wurde am 30. Juni 2026 veröffentlicht. Hier sind die echten API-Preise (Einführungspreis + der Tokenizer-Haken), die Modell-ID und wie man sie auf zwei Arten aufruft.

Claude Sonnet 5 API: Preise, Zugang & Einrichtung (2026)

TL;DR

  • Claude Sonnet 5 (Modell-ID claude-sonnet-5) wurde am 30. Juni 2026 veröffentlicht — Anthropics Mid-Tier-Agentenmodell, nahe Opus-4.8-Qualität zu einem Bruchteil des Preises, mit 1M-Token-Kontextfenster und 128K max. Output
  • Einführungs-API-Preise: $2 / $10 pro 1M Input-/Output-Tokens bis 31. August 2026, danach $3 / $15 — der günstige Tarif hat also ein Ablaufdatum
  • Der Haken hinter dem Framing „kostenneutral“: Sonnet 5 liefert einen neuen Tokenizer, der für denselben Text bis zu 35 % mehr Tokens zählen kann — die effektive Rechnung kann also steigen, obwohl der Token-Preis dem von Sonnet 4.6 entspricht
  • Aufruf direkt über Anthropic oder über den OpenAI-kompatiblen Endpoint von Velokey mit einem Key zu $3 / $15 über Credits

Anthropic hat Claude Sonnet 5 als „kostenneutrales“ Upgrade positioniert — gleicher Token-Preis wie Sonnet 4.6, besseres Modell. Das gilt für den Tarif auf dem Preisblatt und ist irreführend für die Rechnung, die man tatsächlich zahlt, weil Sonnet 5 auch die Token-Zählung geändert hat. Hier, was die API wirklich kostet, die Modell-ID und Specs sowie die zwei Wege zum Aufruf — inklusive dem, der das Setup überspringt.

Claude Sonnet 5 API pricing and access guide
Claude Sonnet 5: Mid-Tier-Agentenmodell, Einführungspreise und ein Tokenizer, der die Rechnung ändert

Was ist Claude Sonnet 5?

Claude Sonnet 5 ist Anthropics Mid-Tier-Modell, veröffentlicht am 30. Juni 2026, gebaut für Planung, Tool Use und autonomes Coding zu einem niedrigeren Preis als die Opus-Stufe. Es erreicht bei vielen agentischen Aufgaben Opus-4.8-Qualität und kostet dabei nur einen Bruchteil.

Die API-Modell-ID lautet claude-sonnet-5. Es bietet ein 1M-Token-Kontextfenster (Standard und Maximum) und bis zu 128K Output-Tokens und unterstützt den vollen modernen Feature-Satz: hochauflösende Vision (bis 2576px), Tool Use, Prompt Caching, Structured Outputs mit JSON Schema, Web Search, Computer Use und Effort-Level bis xhigh. Anthropic berichtet außerdem, dass es sich in agentischen Kontexten sicherer verhält als Sonnet 4.6.

Claude Sonnet 5 auf einen Blick:

SpecDetail
Model IDclaude-sonnet-5
ReleasedJune 30, 2026
Context window1M tokens (default & max)
Max output128K tokens
VisionHigh-res, up to 2576px
FeaturesTool use, caching, structured outputs, web search, computer use, effort (to xhigh)

*Quelle: Anthropic Claude-Sonnet-5-Ankündigung, 2026.*

Die Positionierung ist der Punkt: Es ist das Modell, das man greift, wenn man agentische und Coding-Fähigkeit nahe an Opus will, aber in Volumen ohne Opus-Kosten fahren muss.

Wie viel kostet die Claude Sonnet 5 API?

Claude Sonnet 5 hat einen Einführungspreis von $2 pro 1M Input-Tokens und $10 pro 1M Output bis 31. August 2026, danach gilt der Standardtarif $3 / $15. Beide Daten zählen: Budget auf dem Standardtarif planen, nicht auf der Promo.

Claude Sonnet 5 API-Preise (pro 1M Tokens):

PeriodInputOutput
Intro (through Aug 31, 2026)$2$10
Standard (from Sep 1, 2026)$3$15

*Quelle: Anthropic Pricing, 2026. Der Standardtarif entspricht Claude Sonnet 4.6.*

Claude Sonnet 5 API pricing: intro vs standard
Claude Sonnet 5 Einführungspreise ($2/$10) gelten bis 31. Aug., danach $3/$15

Hier der Teil, den die meisten Pricing-Seiten auslassen. Anthropic nennt Sonnet 5 „kostenneutral“, weil der Standardtarif dem von Sonnet 4.6 entspricht. Aber Sonnet 5 liefert einen neuen Tokenizer, der für exakt denselben Input bis zu 35 % mehr Tokens zählen kann. Gleiche Preisliste, mehr abrechenbare Tokens pro Request — ein Workload, der auf Sonnet 4.6 $X gekostet hat, kann auf Sonnet 5 spürbar teurer werden, noch bevor die Output-Länge ins Spiel kommt.

Was ein Request kostet (vor dem Tokenizer-Effekt):

Rate10K in + 2K out
Intro $2 / $10$0.04
Standard $3 / $15$0.06

*Rechne auf Sonnet 5s Tokenizer bis zu ~35 % mehr Token-Counts — baseliere deine eigenen Prompts neu, bevor du Parität annimmst.*

Zwei praktische Schritte: echte Token-Counts auf claude-sonnet-5 messen (Sonnet-4.6-Schätzungen nicht wiederverwenden) und Prompt Caching nutzen, wo gecachte Reads mit etwa einem Zehntel des Input-Tarifs abgerechnet werden. Für eine ausführlichere Kostenübersicht über die Claude-Linie siehe unseren Claude-API-Preisleitfaden.

Wie ruft man die Claude Sonnet 5 API auf?

Es gibt zwei Wege. Anthropic direkt mit dem anthropic-SDK aufrufen, oder claude-sonnet-5 über Velokeys OpenAI-kompatiblen Endpoint mit einem Key, den man bereits hat. Der zweite ist der schnellere Weg zu einem funktionierenden Request.

Über Velokey (OpenAI-kompatibel, ein Key):

from openai import OpenAI

client = OpenAI(
    base_url="https://api.velokey.ai/v1",
    api_key="sk-velokey-...",   # your Velokey key
)

response = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user", "content": "Draft a migration plan for moving a monolith to services."}],
)
print(response.choices[0].message.content)

Jeden OpenAI-kompatiblen Client auf die Velokey-Base-URL zeigen, den Key tauschen und das Modell setzen — kein Anthropic-Account, kein Tier, kein Data-Retention-Setup, zu $3 / $15 abgerechnet über Velokey-Credits. Velokey erreicht Sonnet 5 neben jedem anderen Modell mit demselben Key.

Direkt über Anthropic (Messages API):

import anthropic

client = anthropic.Anthropic()  # reads ANTHROPIC_API_KEY

response = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=16000,
    output_config={"effort": "high"},   # low | medium | high | xhigh
    messages=[{"role": "user", "content": "..."}],
)
for block in response.content:
    if block.type == "text":
        print(block.text)

Der direkte Weg gibt die native Messages-API-Oberfläche (effort, Thinking, serverseitige Tools). Sonnet 5 sitzt in der neueren Claude-Familie, daher gelten dieselben Request-Regeln wie bei den Geschwistern — kein temperature/top_p und kein fixes Thinking-Budget übergeben. Wenn das mehr Setup ist als gewünscht, spart der OpenAI-kompatible Weg oben das ein.

Wann sollte man Claude Sonnet 5 statt Opus 4.8 nutzen?

Sonnet 5 für den Großteil agentischer und Coding-Arbeit nutzen — Planung, Tool Use, autonomes Coding —, wo man nahe Opus-Qualität zu etwa der Hälfte bis einem Drittel der Kosten will. Opus 4.8 (oder Fable 5) für die härtesten Reasoning- und Long-Horizon-Aufgaben reservieren, die wirklich die Top-Stufe brauchen.

  • Sonnet 5 — Produktions-Agents, Coding-Assistenten, High-Volume-Tool-Calling, alles Kostensensitive, das trotzdem starkes Reasoning braucht. $3 / $15 Standard.
  • Opus 4.8 — die schwierige Minderheit der Aufgaben, bei der die Qualitätslücke die Preislücke rechtfertigt ($5 / $25).
  • Fable 5 — die Frontier-Decke für die anspruchsvollste Arbeit ($10 / $50). Siehe unseren Claude-Fable-5-API-Leitfaden.

Die meisten Teams fahren Sonnet 5 als Default und eskalieren selektiv — dasselbe Muster wie bei einer GPT-5.6-Tier-Entscheidung.

Häufig gestellte Fragen

Wie viel kostet die Claude Sonnet 5 API?

Einführungspreise: $2 pro 1M Input-Tokens und $10 pro 1M Output bis 31. August 2026, danach der Standardtarif $3 / $15. Der Standardtarif entspricht Sonnet 4.6, aber der neue Tokenizer von Sonnet 5 kann für denselben Input bis zu 35 % mehr Tokens zählen — also echten Verbrauch messen, statt anzunehmen, dass Sonnet-4.6-Kosten übertragbar sind.

Was ist die Claude-Sonnet-5-Modell-ID?

Die API-Modell-ID lautet claude-sonnet-5 — der exakte String, ohne Datums-Suffix. Sie hat ein 1M-Token-Kontextfenster und bis zu 128K Output-Tokens und unterstützt Tool Use, Vision, Prompt Caching, Structured Outputs, Web Search und Effort-Level bis xhigh.

Ist Claude Sonnet 5 so gut wie Opus 4.8?

Es erreicht bei vielen agentischen und Coding-Aufgaben Opus-4.8-Qualität zu einem Bruchteil des Preises. Für den Großteil der Produktionsarbeit ist Sonnet 5 der sinnvolle Default; Opus 4.8 oder Fable 5 für die härtesten Reasoning- und Long-Horizon-Aufgaben reservieren, bei denen die Top-Stufe den Preisaufschlag verdient.

Warum heißt Claude Sonnet 5 „kostenneutral“, wenn meine Rechnung gestiegen ist?

Weil der Token-Preis dem von Sonnet 4.6 entspricht. Die Rechnung kann trotzdem steigen, weil Sonnet 5 einen neuen Tokenizer nutzt, der für denselben Text bis zu 35 % mehr Tokens zählt — gleicher Tarif, mehr abrechenbare Tokens. Token-Counts auf claude-sonnet-5 neu baselinen, bevor man annimmt, dass die Kosten unverändert sind.

Wie nutze ich Claude Sonnet 5 ohne Anthropic-Account?

Über ein Unified-API-Gateway aufrufen. Einen OpenAI-kompatiblen Client auf Velokeys Endpoint (https://api.velokey.ai/v1) zeigen, den Velokey-Key verwenden und das Modell auf claude-sonnet-5 setzen — kein Anthropic-Account, kein Tier, kein Data-Retention-Setup, abgerechnet zu $3 / $15 über Credits.


Claude Sonnet 5 ohne Anthropic-Setup? [Hol dir deinen Velokey-API-Key](/model/claude-sonnet-5) und rufe claude-sonnet-5 über einen OpenAI-kompatiblen Endpoint auf — derselbe Key, neben jedem anderen Modell, das du nutzt.


*Zuletzt aktualisiert: 13. Juli 2026. Preise und Specs stammen aus Anthropics Claude-Sonnet-5-Launch. Einführungspreis und Tokenizer-Verhalten werden von Anthropic festgelegt und können sich ändern — aktuelle Zahlen vor Produktionsbudgets verifizieren.*