GPT 5.4 Mini
gpt-5.4-mini est le membre petit, rapide et économique de la famille GPT-5.4 d’OpenAI, conçu pour une production à grand volume avec une faible latence.
Cas d'usage
Assistants en temps réel gpt-5.4-mini · Production à grand volume gpt-5.4-mini
Entrée
Texte, image
Sortie
Texte
Facturation
Par token
Démarrer une conversation
Saisissez un message ci-dessous pour commencer
Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites
Détails des tarifs
Tarification transparente à l'usage, sans frais cachés.
Tarifs détaillés
Détail des tarifs à l'usage
| Spécification | Prix | Officiel | Économie |
|---|---|---|---|
| Input/1M tokens | 0.6 crédits≈$0.6 | 0.75 crédits | -20% |
| Output/1M tokens | 3.6 crédits≈$3.6 | 4.5 crédits | -20% |
| Cache Read/1M tokens | 0.06 crédits≈$0.06 | 0.075 crédits | -20% |
Règles de facturation
- Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
- Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
- Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
- Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
- Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
- L'utilisation est à la demande, avec une déduction transparente des crédits.
* Le coût final dépend du résultat généré.
Modèles associés
Découvrez d'autres modèles de la même famille.
- OpenAIÉconomisez 20%
GPT 5.4
GPT-5.4 Pro is a high-performance general-purpose large language model variant developed by OpenAI.
- OpenAIÉconomisez 20%
GPT 5.5
GPT-5.5 is the latest generation of large language model developed and released by OpenAI.
- AlibabaÉconomisez 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- AnthropicÉconomisez 20%
Claude Fable 5
Anthropic's Mythos-class frontier model, state-of-the-art across coding, agentic work, vision, and scientific research.
API gpt-5.4-mini abordable
Accédez au petit modèle GPT-5.4 rapide et économique d’OpenAI sur Velokey — faible latence, haut débit, texte et vision multimodaux, long contexte et utilisation d’outils solide, avec un endpoint unifié et une tarification inférieure au prix catalogue pour la production à grand volume.
Découvrez gpt-5.4-mini et son accès API
gpt-5.4-mini est le membre petit, rapide et économique de la famille GPT-5.4 d’OpenAI. Il est optimisé pour une faible latence et un haut débit, ce qui le rend bien moins coûteux à exécuter que gpt-5.4 ou gpt-5.5 tout en conservant une qualité solide sur les tâches quotidiennes. Il est multimodal, accepte les entrées texte et image, et prend en charge une longue fenêtre de contexte, l’appel de fonctions, les sorties structurées et le streaming.\n\ngpt-5.4-mini est un excellent choix par défaut pour la production à grand volume, les assistants en temps réel, la classification et l’extraction, ainsi que toute charge de travail sensible aux coûts où vous souhaitez une bonne qualité à bas prix. Velokey fournit une API gpt-5.4-mini abordable et facile à intégrer : un endpoint de chat unifié, un flux de requête clair et une tarification inférieure au prix catalogue pour les systèmes de production, les pipelines d’agents et les outils d’automatisation.
Inférence rapide à faible latence
Optimisé pour la vitesse et le haut débit, gpt-5.4-mini renvoie les réponses rapidement, ce qui en fait un excellent choix pour les assistants en temps réel, le chat et les expériences interactives où chaque milliseconde compte.
Voir la documentation →
Économique à grande échelle
À 0.75 crédits par 1M de tokens d’entrée et 4.5 crédits par 1M de tokens de sortie, gpt-5.4-mini est bien moins cher que gpt-5.4 et gpt-5.5, idéal pour la production à grand volume et les charges de travail sensibles aux coûts.
Voir la documentation →
Vision multimodale et long contexte
Accepte les entrées texte et image avec une longue fenêtre de contexte, ce qui lui permet de rester cohérent sur de longs documents et conversations tout en traitant des tâches de compréhension visuelle en parallèle du texte.
Voir la documentation →
Utilisation d’outils et appel de fonctions solides
Fiable dans la sélection d’outils et la spécification des arguments, gpt-5.4-mini prend en charge l’appel de fonctions et les sorties structurées, ce qui en fait un moteur fiable pour les agents et l’automatisation à bas prix.
Voir la documentation →
Comment déployer l’API gpt-5.4-mini sur Velokey
Démarrez en seulement quelques étapes.
Inscrivez-vous et obtenez une clé API
Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à gpt-5.4-mini.
Configurez les paramètres de requête
Définissez le modèle sur gpt-5-4-mini et soumettez des messages. Ajustez temperature, max_tokens et le streaming pour équilibrer qualité, latence et coût pour le trafic à grand volume.
Intégrez et commencez les appels
Envoyez des requêtes à l’endpoint unifié /v1/chat/completions de Velokey pour alimenter des assistants, des agents et l’automatisation, avec l’utilisation gérée dans une seule console.
Cas d’utilisation concrets pour gpt-5.4-mini
Des assistants en temps réel au traitement de données à grand volume, couvrant de nombreux scénarios sensibles aux coûts.
Assistants et chat en temps réel
Alimente les chats à faible latence, les bots d’assistance et les assistants interactifs où des réponses rapides garantissent une expérience fluide.
Production à grand volume
Gère de grands volumes de requêtes à faible coût, idéal pour les pipelines qui traitent de nombreuses entrées en continu.
Classification et extraction
Fiable pour l’étiquetage, le routage et l’extraction de champs structurés à partir de textes et de documents à grande échelle.
Agents utilisant des outils
Prend en charge l’appel de fonctions et les sorties structurées, un moteur économique pour les agents multi-étapes et l’automatisation.
Charges de travail sensibles aux coûts
Offre une bonne qualité à bas prix, un excellent choix par défaut lorsque le budget compte davantage que la profondeur maximale du raisonnement.
Compréhension visuelle
Lit les images avec le texte pour le sous-titrage, la modération et l’analyse multimodale en production.
Pourquoi choisir Velokey pour gpt-5.4-mini
Remise sur le prix catalogue
Appelez gpt-5.4-mini à un prix plus bas sur Velokey — paiement à l’usage sans abonnement imposé, réduisant le coût initial.
Interface API unifiée
Une seule clé API donne accès à gpt-5.4-mini et à d’autres modèles — plus besoin de gérer plusieurs comptes et clés, ce qui simplifie l’intégration.
Documentation complète et conseils de migration
Les références d’endpoint, les détails des paramètres et les exemples de migration vous aident à déplacer rapidement le trafic à grand volume vers gpt-5.4-mini.
Stable et hautement disponible
Le basculement automatique et les routes de secours stables maintiennent la disponibilité lorsque la route principale est indisponible, garantissant la fiabilité en production.
Référence API
Exemples complets d'appels API et description des paramètres
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-mini",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gpt-5.4-mini",
"created": 1234567890,
"data": { ... }
}FAQ de l’API gpt-5.4-mini
Qu’est-ce que l’API gpt-5.4-mini ?
gpt-5.4-mini est disponible via Velokey en tant que modèle de chat. Définissez le modèle sur gpt-5-4-mini et utilisez l’endpoint propre à la famille.
Quels paramètres gpt-5.4-mini utilise-t-il ?
Le playground affiche les principaux champs pour gpt-5.4-mini, y compris l’identifiant du modèle et les paramètres de génération les plus importants.
Comment gpt-5.4-mini est-il facturé ?
La tarification est affichée sur cette page lorsqu’elle est disponible, et les crédits sont gérés depuis un seul compte Velokey.
Qui devrait utiliser gpt-5.4-mini ?
Il convient aux équipes qui veulent une inférence rapide et économique pour des charges de travail à grand volume et sensibles à la latence via une API unifiée.
Commencez avec GPT 5.4 Mini dès aujourd'hui
Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.