GLM 5.1
GLM-5.1 ist Zhipus Flaggschiff-KI-Modell und überzeugt bei Programmierung, komplexem Schlussfolgern und langkettigen Aufgaben.
Anwendungsfälle
glm-5.1 Prototyping · glm-5.1 Produktions-Workflows
Eingabe
Text, Bild
Ausgabe
Text
Abrechnung
Pro Token
Starten Sie eine Unterhaltung
Geben Sie unten eine Nachricht ein, um zu beginnen
Registrieren und $0.5 Startguthaben erhalten — rund 20 Gratis-Bilder
Preisdetails
Transparente nutzungsbasierte Preise ohne versteckte Gebühren.
Detaillierte Preise
Nutzungsbasierte Preisübersicht
| Spezifikation | Preis | Offiziell | Ersparnis |
|---|---|---|---|
| Input/1M tokens | 1.12 Credits≈$1.12 | 1.4 Credits | -20% |
| Output/1M tokens | 3.52 Credits≈$3.52 | 4.4 Credits | -20% |
| Cache Read/1M tokens | 0.208 Credits≈$0.208 | 0.26 Credits | -20% |
Abrechnungsregeln
- Der Ausgabepreis variiert je nach Modell, Auflösung, Qualität, Dauer oder Token-Verbrauch.
- Hochgeladene Referenzdateien können bei unterstützten Modellen separat berechnet werden.
- Zusatzfunktionen wie Web- oder Bildsuche können pro Anfrage berechnet werden.
- Tokenbasierte Modelle werden nach Eingabe- und Ausgabe-Tokens abgerechnet.
- Ist die primäre Route nicht verfügbar, kann Velokey nach Möglichkeit automatisch auf eine stabile Ausweichroute umschalten.
- Die Nutzung ist Pay-as-you-go mit transparentem Credit-Abzug.
* Die endgültigen Kosten hängen vom generierten Ergebnis ab.
Verwandte Modelle
Entdecken Sie weitere Modelle derselben Familie.
- Zhipu20% sparen
GLM 5.2
GLM-5.2 is Z.ai's flagship model with a 1M-token context, strong project-level coding, stable multi-step execution, and adjustable thinking for long-horizon engineering.
- Zhipu20% sparen
GLM 5
GLM-5 is Z.ai's 744B-parameter (40B active) sparse-attention model with Opus-4.5-level coding, strong agentic tool use, and a 200K context.
- OpenAI20% sparen
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- Alibaba20% sparen
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
Kostengünstige GLM-5.1 API
Greifen Sie auf Z.ai / Zhipus GLM-5.1 auf Velokey zu — bis zu 8 Stunden kontinuierliche autonome Ausführung, agentisches Coding auf Opus-4.6-Niveau, ein autonomer Experimentieren-Analysieren-Optimieren-Zyklus und ein 200K-Token-Kontext mit vollständiger Tool-Integration, alles über einen einheitlichen Endpunkt mit Preisen unter Listenpreis.
GLM-5.1 und seinen API-Zugriff kennenlernen
GLM-5.1 ist das Flaggschiffmodell von Z.ai / Zhipu (request id glm-5-1), entwickelt für autonome Aufgaben mit langem Zeithorizont, komplexe technische Optimierung und reale Entwicklungsworkflows. Seine allgemeine Leistungsfähigkeit ist auf Claude Opus 4.6 ausgerichtet, und es erzielt 58.4 auf SWE-Bench Pro — und übertrifft damit GPT-5.4, Claude Opus 4.6 und Gemini 3.1 Pro. Es wird mit einem 200K-Token-Kontextfenster und bis zu 128K maximaler Ausgabe geliefert, plus Thinking Mode, Streaming, Function Calling, Context Caching, strukturierter Ausgabe (JSON) und MCP-Tool-Integration. Velokey bietet eine kostengünstige, leicht zu integrierende GLM-5.1 API: einen einheitlichen Chat-Endpunkt, einen API-Schlüssel, einen klaren Anfrageablauf und Preise unter Listenpreis für Produktionssysteme, Agenten-Pipelines und Automatisierungstools.
Bis zu 8 Stunden kontinuierliche autonome Ausführung
GLM-5.1 kann bis zu 8 Stunden kontinuierlicher autonomer Ausführung an einer einzelnen Aufgabe arbeiten und dabei Kontext und Dynamik über Arbeiten mit langem Zeithorizont hinweg beibehalten — ideal für große, mehrstufige Projekte, die andernfalls ständige Überwachung erfordern würden.
Dokumentation anzeigen →
Agentisches Coding auf Opus-4.6-Niveau
Allgemeine Leistungsfähigkeit auf Claude Opus 4.6 ausgerichtet, mit einem Score von 58.4 auf SWE-Bench Pro und besser als GPT-5.4, Claude Opus 4.6 und Gemini 3.1 Pro — stark bei agentischem Coding und realen Entwicklungsworkflows.
Dokumentation anzeigen →
Autonomer Experimentieren-Analysieren-Optimieren-Zyklus
GLM-5.1 führt einen autonomen 'experiment - analyze - optimize'-Zyklus für komplexe technische Optimierung aus und liefert eine 3.6x geometrische mittlere Beschleunigung bei KernelBench Level 3 Optimierungsaufgaben.
Dokumentation anzeigen →
200K-Kontext mit vollständiger Tool-Integration
Ein 200K-Token-Kontextfenster und bis zu 128K maximale Ausgabe, kombiniert mit Thinking Mode, Function Calling, MCP-Tool-Integration, Context Caching und strukturierter Ausgabe (JSON) zum Aufbau leistungsfähiger, toolgestützter Agenten.
Dokumentation anzeigen →
So rufen Sie die GLM-5.1 API auf Velokey auf
Starten Sie mit nur wenigen Schritten.
Registrieren und einen API-Schlüssel erhalten
Melden Sie sich in der Velokey Konsole an, um einen API-Schlüssel zu generieren, der jede an GLM-5.1 über den einheitlichen Endpunkt gesendete Anfrage authentifiziert.
Anfrageparameter konfigurieren
Setzen Sie model auf glm-5-1 und senden Sie messages. Aktivieren Sie Thinking Mode für tieferes Schlussfolgern und schalten Sie Streaming, Function Calling oder strukturierte Ausgabe ein, wenn Ihr Workflow es erfordert.
Integrieren und Aufrufe starten
Senden Sie Anfragen an Velokeys einheitlichen Endpunkt, um langlaufende Agenten, Coding-Aufgaben und Automatisierung zu betreiben, wobei Nutzung und Abrechnung in einer Konsole verwaltet werden.
Praxisnahe Anwendungsfälle für GLM-5.1
Von langlaufenden Agenten bis hin zur Büroproduktivität, mit Abdeckung vieler Szenarien mit hoher Autonomie.
Agentisches Coding & langlaufende Entwicklungsaufgaben
Mit bis zu 8 Stunden kontinuierlicher autonomer Ausführung und Coding auf Opus-4.6-Niveau, geeignet für agentisches Coding und langlaufende Entwicklungsaufgaben.
Befolgen komplexer Anweisungen
Allgemeine Konversation mit komplexen, mehrschichtigen Anweisungen und kohärentem Verhalten über lange, detaillierte Prompts hinweg.
Kreatives Schreiben
Geeignet für kreatives Schreiben, das eine konsistente Stimme, Struktur und Langform-Kohärenz benötigt.
Front-End-Entwicklung & Website-Generierung
Geeignet für Front-End-Entwicklung und vollständige Website-Generierung, um Briefings in funktionierende Layouts und Komponenten zu verwandeln.
Büroproduktivität
Erstellen und bearbeiten Sie PowerPoint-, Word-, PDF- und Excel-Ausgaben für wiederholbare Büroproduktivitätsaufgaben.
Technische Optimierung
Der autonome Experimentieren-Analysieren-Optimieren-Zyklus liefert eine 3.6x Beschleunigung auf KernelBench Level 3 — geeignet für komplexe technische Optimierung.
Warum Velokey für GLM-5.1 wählen
Preise unter Listenpreis
Rufen Sie GLM-5.1 zu einem niedrigeren Preis auf Velokey auf — Pay-as-you-go ohne erzwungenes Abonnement, wodurch die Vorabkosten sinken.
Einheitlicher Endpunkt, ein API-Schlüssel
Ein API-Schlüssel greift über einen einzigen einheitlichen Endpunkt auf GLM-5.1 und andere Modelle zu — kein Jonglieren mit mehreren Konten und Schlüsseln.
Vollständige Tool-Integration
Thinking Mode, Streaming, Function Calling, Context Caching, strukturierte Ausgabe (JSON) und MCP-Tool-Integration sind sofort einsatzbereit.
Vollständige Dokumentation und Integrationsanleitung
Endpunktreferenzen, Parameterdetails und Integrationsbeispiele helfen Ihnen, den 200K-Kontext von GLM-5.1, Autonomie mit langem Zeithorizont und Tools reibungslos zu übernehmen.
API-Referenz
Vollständige API-Aufrufbeispiele und Parameterbeschreibungen
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.1",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "glm-5.1",
"created": 1234567890,
"data": { ... }
}glm-5.1 API FAQ
Was ist die glm-5.1 API?
glm-5.1 ist über Velokey als Chat-Modell verfügbar. Setzen Sie model auf glm-5-1 und verwenden Sie den familienspezifischen Endpunkt.
Welche Parameter verwendet glm-5.1?
Der Playground zeigt die wichtigsten Felder für glm-5.1, einschließlich der Modell-ID und der wichtigsten Generierungsparameter.
Wie wird glm-5.1 abgerechnet?
Die Preise werden auf dieser Seite angezeigt, sofern verfügbar, und Credits werden über ein einziges Velokey Konto verwaltet.
Wer sollte glm-5.1 verwenden?
Es eignet sich für Teams, die KI-Funktionen über eine einheitliche API testen, vergleichen und ausliefern möchten.
Starten Sie noch heute mit GLM 5.1
Greifen Sie mit einem einzigen API-Schlüssel über Velokey auf günstige, stabile KI-Modelle zu.