GLM 5.1
GLM-5.1 est le modèle d’IA phare de Zhipu, excellent en programmation, en raisonnement complexe et pour les tâches à longue chaîne.
Cas d'usage
Prototypage avec glm-5.1 · Workflows de production avec glm-5.1
Entrée
Texte, image
Sortie
Texte
Facturation
Par token
Démarrer une conversation
Saisissez un message ci-dessous pour commencer
Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites
Détails des tarifs
Tarification transparente à l'usage, sans frais cachés.
Tarifs détaillés
Détail des tarifs à l'usage
| Spécification | Prix | Officiel | Économie |
|---|---|---|---|
| Input/1M tokens | 1.12 crédits≈$1.12 | 1.4 crédits | -20% |
| Output/1M tokens | 3.52 crédits≈$3.52 | 4.4 crédits | -20% |
| Cache Read/1M tokens | 0.208 crédits≈$0.208 | 0.26 crédits | -20% |
Règles de facturation
- Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
- Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
- Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
- Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
- Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
- L'utilisation est à la demande, avec une déduction transparente des crédits.
* Le coût final dépend du résultat généré.
Modèles associés
Découvrez d'autres modèles de la même famille.
- ZhipuÉconomisez 20%
GLM 5.2
GLM-5.2 is Z.ai's flagship model with a 1M-token context, strong project-level coding, stable multi-step execution, and adjustable thinking for long-horizon engineering.
- ZhipuÉconomisez 20%
GLM 5
GLM-5 is Z.ai's 744B-parameter (40B active) sparse-attention model with Opus-4.5-level coding, strong agentic tool use, and a 200K context.
- OpenAIÉconomisez 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- AlibabaÉconomisez 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
API GLM-5.1 abordable
Accédez au GLM-5.1 de Z.ai / Zhipu sur Velokey — jusqu’à 8 heures d’exécution autonome soutenue, codage agentique de niveau Opus-4.6, boucle autonome expérimenter-analyser-optimiser, et contexte de 200K tokens avec intégration complète des outils, le tout via un endpoint unifié avec des tarifs inférieurs au prix catalogue.
Découvrez GLM-5.1 et son accès API
GLM-5.1 est le modèle phare de Z.ai / Zhipu (identifiant de requête glm-5-1), conçu pour les tâches autonomes à long horizon, l’optimisation d’ingénierie complexe et les workflows de développement réels. Sa capacité générale est alignée sur Claude Opus 4.6, et il obtient 58.4 sur SWE-Bench Pro — surpassant GPT-5.4, Claude Opus 4.6 et Gemini 3.1 Pro. Il est fourni avec une fenêtre de contexte de 200K tokens et jusqu’à 128K de sortie maximale, ainsi que Thinking Mode, le streaming, l’appel de fonctions, la mise en cache du contexte, la sortie structurée (JSON) et l’intégration des outils MCP. Velokey fournit une API GLM-5.1 abordable et facile à intégrer : un endpoint de chat unifié, une seule clé API, un flux de requête clair et des tarifs inférieurs au prix catalogue pour les systèmes de production, les pipelines d’agents et les outils d’automatisation.
Jusqu’à 8 heures d’exécution autonome soutenue
GLM-5.1 peut rester sur une seule tâche jusqu’à 8 heures d’exécution autonome soutenue, en conservant le contexte et l’élan sur un travail à long horizon — idéal pour les grands projets en plusieurs étapes qui nécessiteraient autrement une supervision constante.
Voir la documentation →
Codage agentique de niveau Opus-4.6
Capacité générale alignée sur Claude Opus 4.6, avec un score de 58.4 sur SWE-Bench Pro et des performances supérieures à GPT-5.4, Claude Opus 4.6 et Gemini 3.1 Pro — solide pour le codage agentique et les workflows de développement réels.
Voir la documentation →
Boucle autonome expérimenter-analyser-optimiser
GLM-5.1 exécute une boucle autonome « expérimenter - analyser - optimiser » pour l’optimisation d’ingénierie complexe, offrant une accélération par moyenne géométrique de 3.6x sur les tâches d’optimisation KernelBench Level 3.
Voir la documentation →
Contexte 200K avec intégration complète des outils
Une fenêtre de contexte de 200K tokens et jusqu’à 128K de sortie maximale, associées à Thinking Mode, à l’appel de fonctions, à l’intégration des outils MCP, à la mise en cache du contexte et à la sortie structurée (JSON) pour créer des agents performants pilotés par des outils.
Voir la documentation →
Comment appeler l’API GLM-5.1 sur Velokey
Commencez en quelques étapes seulement.
Inscrivez-vous et obtenez une clé API
Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à GLM-5.1 via l’endpoint unifié.
Configurez les paramètres de requête
Définissez le modèle sur glm-5-1 et soumettez des messages. Activez Thinking Mode pour un raisonnement plus approfondi, et activez le streaming, l’appel de fonctions ou la sortie structurée selon les besoins de votre workflow.
Intégrez et commencez les appels
Envoyez des requêtes à l’endpoint unifié de Velokey pour alimenter des agents longue durée, des tâches de codage et l’automatisation, avec l’utilisation et la facturation gérées dans une seule console.
Cas d’utilisation concrets de GLM-5.1
Des agents longue durée à la productivité bureautique, couvrant de nombreux scénarios à forte autonomie.
Codage agentique et tâches de développement longues
Avec jusqu’à 8 heures d’exécution autonome soutenue et un codage de niveau Opus-4.6, adapté au codage agentique et aux tâches de développement longues.
Suivi d’instructions complexes
Conversation générale avec suivi d’instructions complexes à contraintes multiples, tout en restant cohérent sur des prompts longs et détaillés.
Écriture créative
Adapté à l’écriture créative qui nécessite une voix cohérente, une structure et une cohérence longue forme.
Développement front-end et génération de sites web
Adapté au développement front-end et à la génération de sites web complets, transformant des briefs en mises en page et composants fonctionnels.
Productivité bureautique
Générez et modifiez des sorties PowerPoint, Word, PDF et Excel pour un travail de productivité bureautique répétable.
Optimisation d’ingénierie
La boucle autonome expérimenter-analyser-optimiser offre une accélération de 3.6x sur KernelBench Level 3 — adaptée à l’optimisation d’ingénierie complexe.
Pourquoi choisir Velokey pour GLM-5.1
Tarifs inférieurs au prix catalogue
Appelez GLM-5.1 à un prix inférieur sur Velokey — paiement à l’usage sans abonnement imposé, réduisant le coût initial.
Endpoint unifié, une seule clé API
Une seule clé API donne accès à GLM-5.1 et à d’autres modèles via un endpoint unifié unique — plus besoin de jongler avec plusieurs comptes et clés.
Intégration complète des outils
Thinking Mode, streaming, appel de fonctions, mise en cache du contexte, sortie structurée (JSON) et intégration des outils MCP sont prêts à l’emploi.
Documentation complète et conseils d’intégration
Les références d’endpoint, les détails des paramètres et les exemples d’intégration vous aident à adopter en douceur le contexte 200K de GLM-5.1, son autonomie à long horizon et ses outils.
Référence API
Exemples complets d'appels API et description des paramètres
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.1",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "glm-5.1",
"created": 1234567890,
"data": { ... }
}FAQ de l’API glm-5.1
Qu’est-ce que l’API glm-5.1 ?
glm-5.1 est disponible via Velokey en tant que modèle de chat. Définissez le modèle sur glm-5-1 et utilisez l’endpoint propre à la famille.
Quels paramètres glm-5.1 utilise-t-il ?
Le playground affiche les principaux champs pour glm-5.1, notamment l’identifiant du modèle et les paramètres de génération les plus importants.
Comment glm-5.1 est-il facturé ?
Les tarifs sont affichés sur cette page lorsqu’ils sont disponibles, et les crédits sont gérés depuis un seul compte Velokey.
Qui devrait utiliser glm-5.1 ?
Il convient aux équipes qui souhaitent tester, comparer et déployer des capacités d’IA via une API unifiée.
Commencez avec GLM 5.1 dès aujourd'hui
Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.