Velokey

Gemini 3 Flash Preview

GoogleChatin 0.4 · out 2.4 Crédits / 1M tokens≈$0.4 / $2.4Disponible

Gemini 3 Flash est le modèle de Google DeepMind qui associe un raisonnement de niveau Pro à une latence, une efficacité et un coût de niveau Flash. Accédez-y via le point de terminaison unifié de Velokey avec une tarification inférieure au prix catalogue.

Raisonnement de niveau ProSWE-bench 78%3x plus rapide que 2.5 ProImage et vidéo multimodales

Cas d'usage

Codage agentique et développement itératif · Applications interactives et grand public

Entrée

Texte, image

Sortie

Texte

Facturation

Par token

0.7
02
2048
2568192
gemini-3-flash-preview

Démarrer une conversation

Saisissez un message ci-dessous pour commencer

Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites

Détails des tarifs

Tarification transparente à l'usage, sans frais cachés.

Tarifs détaillés

Détail des tarifs à l'usage

SpécificationPrixOfficielÉconomie
Input/1M tokens0.4 crédits≈$0.40.5 crédits-20%
Output/1M tokens2.4 crédits≈$2.43 crédits-20%
Cache Read/1M tokens0.04 crédits≈$0.040.05 crédits-20%

Règles de facturation

  • Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
  • Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
  • Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
  • Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
  • Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
  • L'utilisation est à la demande, avec une déduction transparente des crédits.

* Le coût final dépend du résultat généré.

API Gemini 3 Flash abordable

Accédez au Gemini 3 Flash de Google sur Velokey — raisonnement de niveau Pro, codage de premier plan et compréhension multimodale avec une latence et un coût de niveau Flash, via un point de terminaison unifié et une tarification inférieure au prix catalogue pour les applications de production.

Découvrez Gemini 3 Flash et son accès API

Gemini 3 Flash est le modèle de Google DeepMind publié le 17 décembre 2025, associant un raisonnement de niveau Pro à une latence, une efficacité et un coût de niveau Flash. Il combine un raisonnement de pointe avec la vitesse de la série Flash — 90.4% sur GPQA Diamond, 78% sur SWE-bench Verified (surpassant à la fois la série 2.5 et Gemini 3 Pro), et 81.2% sur MMMU Pro, comparable à Gemini 3 Pro. Il fonctionne environ 3x plus vite que Gemini 2.5 Pro et utilise environ 30% de tokens en moins sur les tâches typiques. Velokey fournit une API Gemini 3 Flash abordable et facile à intégrer : un point de terminaison de chat unifié, un flux de requête clair et une tarification inférieure au prix catalogue affichée dans le tableau de bord de votre console pour les systèmes de production, les pipelines d’agents et les applications grand public.

Raisonnement de niveau Pro au coût Flash

Combine un raisonnement de pointe avec la vitesse de la série Flash : 90.4% sur GPQA Diamond et 33.7% sur Humanity's Last Exam (sans outils), surpassant Gemini 2.5 Pro sur plusieurs benchmarks — le tout avec une latence et un coût de niveau Flash.

Voir la documentation
Raisonnement de niveau Pro au coût Flash

Codage de premier plan qui bat 3 Pro

Obtient 78% sur SWE-bench Verified, surpassant à la fois la série Gemini 2.5 et Gemini 3 Pro — adapté au codage agentique, à l’utilisation d’outils et aux boucles de développement itératif.

Voir la documentation
Codage de premier plan qui bat 3 Pro

3x plus rapide avec 30% de tokens en moins

Fonctionne environ 3x plus vite que Gemini 2.5 Pro et utilise en moyenne environ 30% de tokens en moins pour les tâches typiques, optimisé pour les workflows à faible latence et haute fréquence.

Voir la documentation
3x plus rapide avec 30% de tokens en moins

Compréhension multimodale en temps réel

Gère l’analyse vidéo, la compréhension d’images et les questions-réponses visuelles, adapté aux scénarios multimodaux en temps réel tels que l’assistance dans les jeux et l’itération de conception.

Voir la documentation
Compréhension multimodale en temps réel

Comment déployer l’API Gemini 3 Flash sur Velokey

Commencez en quelques étapes seulement.

1

Inscrivez-vous et obtenez une clé API

Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à Gemini 3 Flash.

2

Configurez les paramètres de requête

Définissez le modèle sur gemini-3-flash et soumettez des messages. Ajoutez des images ou des vidéos pour les tâches multimodales et gardez des requêtes légères pour bénéficier de la latence de niveau Flash.

3

Intégrez et commencez à appeler

Envoyez des requêtes au point de terminaison unifié /v1/chat/completions de Velokey pour alimenter des assistants, des agents et des applications interactives, avec l’utilisation gérée dans une seule console.

Cas d’utilisation concrets de Gemini 3 Flash

De l’ingénierie aux produits interactifs, couvrant de nombreux scénarios à faible latence.

Codage agentique et développement itératif

78% sur SWE-bench Verified avec une latence de niveau Flash — adapté au codage agentique, à l’itération rapide et aux boucles de développement utilisant des outils.

Applications interactives nécessitant des réponses rapides

Faible latence et faible coût — adaptés aux applications interactives qui nécessitent des réponses rapides et à haute fréquence.

Analyse multimodale en temps réel

Vidéo, image et questions-réponses visuelles — adaptées aux scénarios en temps réel comme l’assistance dans les jeux et l’itération de conception.

Tâches de raisonnement complexes

90.4% sur GPQA Diamond et 33.7% sur Humanity's Last Exam (sans outils) — adapté aux problèmes difficiles de science et de raisonnement.

Workflows à haute fréquence

Environ 3x plus rapide que 2.5 Pro avec ~30% de tokens en moins — adapté aux pipelines à haut débit et sensibles aux coûts.

Applications grand public

Vitesse et coût de niveau Flash — adaptés aux produits grand public servant de nombreux utilisateurs à grande échelle.

Pourquoi choisir Velokey pour Gemini 3 Flash

Remise sur le prix catalogue

Appelez Gemini 3 Flash à un prix plus bas sur Velokey — paiement à l’utilisation sans abonnement imposé, réduisant le coût initial.

Interface API unifiée

Une seule clé API donne accès à Gemini 3 Flash et à d’autres modèles — plus besoin de jongler avec plusieurs comptes et clés, ce qui simplifie l’intégration.

Documentation et exemples complets

Les références de points de terminaison, les détails des paramètres et les exemples multimodaux vous aident à intégrer rapidement raisonnement, codage et vision.

Stable et hautement disponible

Le basculement automatique et les routes de secours stables maintiennent la disponibilité lorsque la route principale est hors service, assurant la fiabilité en production.

Référence API

Exemples complets d'appels API et description des paramètres

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3-flash-preview",
  "created": 1234567890,
  "data": { ... }
}

FAQ de l’API Gemini 3 Flash

Qu’est-ce qui différencie Gemini 3 Flash ?

Il associe un raisonnement de niveau Pro à une latence, une efficacité et un coût de niveau Flash, combinant un raisonnement de pointe avec la vitesse de la série Flash. Il atteint 90.4% sur GPQA Diamond, 78% sur SWE-bench Verified et 81.2% sur MMMU Pro, tout en fonctionnant environ 3x plus vite que Gemini 2.5 Pro.

Comment son codage se compare-t-il à Gemini 3 Pro ?

Sur SWE-bench Verified, il obtient 78%, surpassant à la fois la série Gemini 2.5 et Gemini 3 Pro — solide pour le codage agentique et le développement itératif avec une latence bien plus faible.

Quelle est sa rapidité et son efficacité ?

Il fonctionne environ 3x plus vite que Gemini 2.5 Pro et utilise en moyenne environ 30% de tokens en moins pour les tâches typiques, ce qui l’optimise pour les workflows à faible latence et haute fréquence.

Quelles entrées multimodales prend-il en charge ?

Il prend en charge l’analyse vidéo, la compréhension d’images et les questions-réponses visuelles, adapté aux scénarios multimodaux en temps réel tels que l’assistance dans les jeux et l’itération de conception.

Comment est-il facturé sur Velokey ?

Il est facturé selon les tokens d’entrée et de sortie, avec une remise sur le prix catalogue. Le prix actuel de Velokey est affiché dans la zone de tarification de cette page et dans le tableau de bord de votre console, sans abonnement imposé.

Commencez avec Gemini 3 Flash Preview dès aujourd'hui

Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.