Gemini 3 Flash Preview
Gemini 3 Flash est le modèle de Google DeepMind qui associe un raisonnement de niveau Pro à une latence, une efficacité et un coût de niveau Flash. Accédez-y via le point de terminaison unifié de Velokey avec une tarification inférieure au prix catalogue.
Cas d'usage
Codage agentique et développement itératif · Applications interactives et grand public
Entrée
Texte, image
Sortie
Texte
Facturation
Par token
Démarrer une conversation
Saisissez un message ci-dessous pour commencer
Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites
Détails des tarifs
Tarification transparente à l'usage, sans frais cachés.
Tarifs détaillés
Détail des tarifs à l'usage
| Spécification | Prix | Officiel | Économie |
|---|---|---|---|
| Input/1M tokens | 0.4 crédits≈$0.4 | 0.5 crédits | -20% |
| Output/1M tokens | 2.4 crédits≈$2.4 | 3 crédits | -20% |
| Cache Read/1M tokens | 0.04 crédits≈$0.04 | 0.05 crédits | -20% |
Règles de facturation
- Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
- Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
- Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
- Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
- Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
- L'utilisation est à la demande, avec une déduction transparente des crédits.
* Le coût final dépend du résultat généré.
Modèles associés
Découvrez d'autres modèles de la même famille.
- GoogleÉconomisez 20%
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- GoogleÉconomisez 20%
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- GoogleÉconomisez 20%
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash is Google's most cost-efficient model in the 3 series, with flexible reasoning, multimodal input and a 1M-token context for high-volume, low-latency tasks.
- GoogleÉconomisez 20%
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
API Gemini 3 Flash abordable
Accédez au Gemini 3 Flash de Google sur Velokey — raisonnement de niveau Pro, codage de premier plan et compréhension multimodale avec une latence et un coût de niveau Flash, via un point de terminaison unifié et une tarification inférieure au prix catalogue pour les applications de production.
Découvrez Gemini 3 Flash et son accès API
Gemini 3 Flash est le modèle de Google DeepMind publié le 17 décembre 2025, associant un raisonnement de niveau Pro à une latence, une efficacité et un coût de niveau Flash. Il combine un raisonnement de pointe avec la vitesse de la série Flash — 90.4% sur GPQA Diamond, 78% sur SWE-bench Verified (surpassant à la fois la série 2.5 et Gemini 3 Pro), et 81.2% sur MMMU Pro, comparable à Gemini 3 Pro. Il fonctionne environ 3x plus vite que Gemini 2.5 Pro et utilise environ 30% de tokens en moins sur les tâches typiques. Velokey fournit une API Gemini 3 Flash abordable et facile à intégrer : un point de terminaison de chat unifié, un flux de requête clair et une tarification inférieure au prix catalogue affichée dans le tableau de bord de votre console pour les systèmes de production, les pipelines d’agents et les applications grand public.
Raisonnement de niveau Pro au coût Flash
Combine un raisonnement de pointe avec la vitesse de la série Flash : 90.4% sur GPQA Diamond et 33.7% sur Humanity's Last Exam (sans outils), surpassant Gemini 2.5 Pro sur plusieurs benchmarks — le tout avec une latence et un coût de niveau Flash.
Voir la documentation →
Codage de premier plan qui bat 3 Pro
Obtient 78% sur SWE-bench Verified, surpassant à la fois la série Gemini 2.5 et Gemini 3 Pro — adapté au codage agentique, à l’utilisation d’outils et aux boucles de développement itératif.
Voir la documentation →
3x plus rapide avec 30% de tokens en moins
Fonctionne environ 3x plus vite que Gemini 2.5 Pro et utilise en moyenne environ 30% de tokens en moins pour les tâches typiques, optimisé pour les workflows à faible latence et haute fréquence.
Voir la documentation →
Compréhension multimodale en temps réel
Gère l’analyse vidéo, la compréhension d’images et les questions-réponses visuelles, adapté aux scénarios multimodaux en temps réel tels que l’assistance dans les jeux et l’itération de conception.
Voir la documentation →
Comment déployer l’API Gemini 3 Flash sur Velokey
Commencez en quelques étapes seulement.
Inscrivez-vous et obtenez une clé API
Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à Gemini 3 Flash.
Configurez les paramètres de requête
Définissez le modèle sur gemini-3-flash et soumettez des messages. Ajoutez des images ou des vidéos pour les tâches multimodales et gardez des requêtes légères pour bénéficier de la latence de niveau Flash.
Intégrez et commencez à appeler
Envoyez des requêtes au point de terminaison unifié /v1/chat/completions de Velokey pour alimenter des assistants, des agents et des applications interactives, avec l’utilisation gérée dans une seule console.
Cas d’utilisation concrets de Gemini 3 Flash
De l’ingénierie aux produits interactifs, couvrant de nombreux scénarios à faible latence.
Codage agentique et développement itératif
78% sur SWE-bench Verified avec une latence de niveau Flash — adapté au codage agentique, à l’itération rapide et aux boucles de développement utilisant des outils.
Applications interactives nécessitant des réponses rapides
Faible latence et faible coût — adaptés aux applications interactives qui nécessitent des réponses rapides et à haute fréquence.
Analyse multimodale en temps réel
Vidéo, image et questions-réponses visuelles — adaptées aux scénarios en temps réel comme l’assistance dans les jeux et l’itération de conception.
Tâches de raisonnement complexes
90.4% sur GPQA Diamond et 33.7% sur Humanity's Last Exam (sans outils) — adapté aux problèmes difficiles de science et de raisonnement.
Workflows à haute fréquence
Environ 3x plus rapide que 2.5 Pro avec ~30% de tokens en moins — adapté aux pipelines à haut débit et sensibles aux coûts.
Applications grand public
Vitesse et coût de niveau Flash — adaptés aux produits grand public servant de nombreux utilisateurs à grande échelle.
Pourquoi choisir Velokey pour Gemini 3 Flash
Remise sur le prix catalogue
Appelez Gemini 3 Flash à un prix plus bas sur Velokey — paiement à l’utilisation sans abonnement imposé, réduisant le coût initial.
Interface API unifiée
Une seule clé API donne accès à Gemini 3 Flash et à d’autres modèles — plus besoin de jongler avec plusieurs comptes et clés, ce qui simplifie l’intégration.
Documentation et exemples complets
Les références de points de terminaison, les détails des paramètres et les exemples multimodaux vous aident à intégrer rapidement raisonnement, codage et vision.
Stable et hautement disponible
Le basculement automatique et les routes de secours stables maintiennent la disponibilité lorsque la route principale est hors service, assurant la fiabilité en production.
Référence API
Exemples complets d'appels API et description des paramètres
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3-flash-preview",
"created": 1234567890,
"data": { ... }
}FAQ de l’API Gemini 3 Flash
Qu’est-ce qui différencie Gemini 3 Flash ?
Il associe un raisonnement de niveau Pro à une latence, une efficacité et un coût de niveau Flash, combinant un raisonnement de pointe avec la vitesse de la série Flash. Il atteint 90.4% sur GPQA Diamond, 78% sur SWE-bench Verified et 81.2% sur MMMU Pro, tout en fonctionnant environ 3x plus vite que Gemini 2.5 Pro.
Comment son codage se compare-t-il à Gemini 3 Pro ?
Sur SWE-bench Verified, il obtient 78%, surpassant à la fois la série Gemini 2.5 et Gemini 3 Pro — solide pour le codage agentique et le développement itératif avec une latence bien plus faible.
Quelle est sa rapidité et son efficacité ?
Il fonctionne environ 3x plus vite que Gemini 2.5 Pro et utilise en moyenne environ 30% de tokens en moins pour les tâches typiques, ce qui l’optimise pour les workflows à faible latence et haute fréquence.
Quelles entrées multimodales prend-il en charge ?
Il prend en charge l’analyse vidéo, la compréhension d’images et les questions-réponses visuelles, adapté aux scénarios multimodaux en temps réel tels que l’assistance dans les jeux et l’itération de conception.
Comment est-il facturé sur Velokey ?
Il est facturé selon les tokens d’entrée et de sortie, avec une remise sur le prix catalogue. Le prix actuel de Velokey est affiché dans la zone de tarification de cette page et dans le tableau de bord de votre console, sans abonnement imposé.
Commencez avec Gemini 3 Flash Preview dès aujourd'hui
Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.