Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash est le modèle Gemini 3 le plus rentable de Google (preview), avec une intelligence solide, un débit élevé et une entrée multimodale. Accédez-y via le point de terminaison unifié de Velokey avec une tarification inférieure au prix catalogue.
Cas d'usage
Codage et génération d’UI · Traduction et étiquetage de données à grande échelle
Entrée
Texte, image
Sortie
Texte
Facturation
Par token
Démarrer une conversation
Saisissez un message ci-dessous pour commencer
Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites
Détails des tarifs
Tarification transparente à l'usage, sans frais cachés.
Tarifs détaillés
Détail des tarifs à l'usage
| Spécification | Prix | Officiel | Économie |
|---|---|---|---|
| Input/1M tokens | 0.2 crédits≈$0.2 | 0.25 crédits | -20% |
| Output/1M tokens | 1.2 crédits≈$1.2 | 1.5 crédits | -20% |
| Cache Read/1M tokens | 0.02 crédits≈$0.02 | 0.025 crédits | -20% |
Règles de facturation
- Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
- Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
- Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
- Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
- Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
- L'utilisation est à la demande, avec une déduction transparente des crédits.
* Le coût final dépend du résultat généré.
Modèles associés
Découvrez d'autres modèles de la même famille.
- GoogleÉconomisez 20%
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- GoogleÉconomisez 20%
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- GoogleÉconomisez 20%
Gemini 3 Flash Preview
Gemini 3 Flash brings Pro-grade reasoning at Flash-level latency and cost — strong coding (SWE-bench 78%), 3x faster than 2.5 Pro, and multimodal understanding.
- GoogleÉconomisez 20%
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
API Gemini 3.1 Flash abordable
Accédez au modèle Gemini 3 le plus rentable de Google DeepMind sur Velokey — haut débit, niveaux de raisonnement flexibles et entrée multimodale de 1M de tokens, avec un point de terminaison unifié et une tarification inférieure au prix catalogue pour les applications de production.
Découvrez Gemini 3.1 Flash et son accès API
Gemini 3.1 Flash est le modèle le plus rentable de Google DeepMind dans la série Gemini 3 (preview). Il associe une intelligence solide à un haut débit de 363 tokens/seconde et une faible latence, ajoute des niveaux de raisonnement flexibles afin que vous puissiez adapter le calcul à la complexité de chaque tâche, et accepte les entrées multimodales — texte, image, vidéo, audio et PDF — sur une fenêtre de contexte de 1M de tokens avec appel de fonctions, sortie structurée, ancrage dans la recherche et exécution de code. Il surpasse Gemini 2.5 Flash sur GPQA Diamond, MMMU-Pro et la génération de code. Velokey fournit une API Gemini 3.1 Flash abordable et facile à intégrer : un point de terminaison de chat unifié, un flux de requête clair et une tarification inférieure au prix catalogue pour les systèmes de production, les pipelines à haut volume et les applications en temps réel.
Le plus rentable de la série Gemini 3
Le modèle le plus rentable de la série Gemini 3, associant une intelligence solide à un prix bas afin que les charges de travail à haut volume restent abordables sans sacrifier la qualité.
Voir la documentation →
Grande vitesse et faible latence
Génère environ 363 tokens/seconde avec une faible latence, maintenant les tâches à haut volume et sensibles à la latence réactives — idéal pour la génération de contenu en temps réel à grande échelle.
Voir la documentation →
Niveaux de raisonnement flexibles
Augmentez ou réduisez la profondeur de raisonnement pour chaque requête afin de correspondre à la complexité variable des tâches — économique et instantané pour les travaux simples, plus approfondi lorsqu’une tâche en a vraiment besoin.
Voir la documentation →
Entrée multimodale de 1M de tokens avec outils
Accepte texte, image, vidéo, audio et PDF sur un contexte d’entrée de 1M de tokens, avec appel de fonctions, sortie structurée, ancrage dans la recherche et exécution de code pour de vrais workflows d’agents.
Voir la documentation →
Comment déployer l’API Gemini 3.1 Flash sur Velokey
Démarrez en seulement quelques étapes.
Inscrivez-vous et obtenez une clé API
Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à gemini-3-1-flash.
Configurez les paramètres de requête
Définissez le modèle sur gemini-3-1-flash et soumettez des messages. Choisissez un niveau de raisonnement flexible pour équilibrer la profondeur et la vitesse, et joignez une entrée texte, image, vidéo, audio ou PDF selon vos besoins.
Intégrez et commencez à appeler
Envoyez des requêtes au point de terminaison unifié /v1/chat/completions de Velokey pour alimenter des assistants, des pipelines à haut volume et des applications en temps réel, avec l’utilisation gérée dans une seule console.
Cas d’utilisation concrets pour Gemini 3.1 Flash
Du codage au travail de données à grande échelle, couvrant de nombreux scénarios à haut volume.
Codage et génération d’UI
Forte qualité de génération de code avec faible latence — adapté aux assistants de codage et à la génération d’UI à grande échelle lorsque la vitesse et le coût comptent tous les deux.
Traduction à grande échelle
Rentable et rapide — adapté aux pipelines de traduction à haut volume qui traitent en continu de grands lots de contenu.
Étiquetage de données à grande échelle
Faible coût par appel et haut débit — adapté à l’étiquetage et à l’annotation de grands jeux de données sur des tâches de longue durée.
Génération de contenu en temps réel
363 tokens/seconde avec faible latence — adapté à la génération de contenu en temps réel dans les produits live et les expériences interactives.
Raisonnement sensible à la latence
Les niveaux de raisonnement flexibles vous permettent de garder des réponses rapides tout en raisonnant lorsque c’est nécessaire — adapté aux assistants sensibles à la latence.
Compréhension multimodale
Prend des entrées texte, image, vidéo, audio et PDF sur un contexte de 1M de tokens — adapté à l’analyse et au résumé de contenu multimédia mixte.
Pourquoi choisir Velokey pour Gemini 3.1 Flash
Remise sur le prix catalogue
Appelez Gemini 3.1 Flash à un prix plus bas sur Velokey — paiement à l’usage sans abonnement imposé, pour maintenir les charges de travail à haut volume abordables.
Interface API unifiée
Une seule clé API permet d’accéder à Gemini 3.1 Flash et à d’autres modèles — plus besoin de jongler avec plusieurs comptes et clés, ce qui simplifie l’intégration.
Documentation complète et conseils d’intégration
Des références de points de terminaison, des détails de paramètres et des exemples vous aident à intégrer rapidement les niveaux de raisonnement, l’entrée multimodale et l’utilisation d’outils.
Stable et hautement disponible
Le basculement automatique et des routes de secours stables maintiennent la disponibilité lorsque la route principale est indisponible, gardant la production fiable.
Référence API
Exemples complets d'appels API et description des paramètres
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3.1-flash-lite-preview",
"created": 1234567890,
"data": { ... }
}FAQ de l’API Gemini 3.1 Flash
À quoi Gemini 3.1 Flash est-il le mieux adapté ?
C’est le modèle le plus rentable de la série Gemini 3 (preview), conçu pour les tâches à haut volume qui nécessitent efficacité et intelligence — codage et génération d’UI, traduction, étiquetage de données à grande échelle, génération de contenu en temps réel et raisonnement sensible à la latence.
Quelle est sa vitesse ?
Il génère environ 363 tokens/seconde avec une faible latence, ce qui le rend bien adapté aux charges de travail à haut volume et sensibles à la latence. Les niveaux de raisonnement flexibles vous permettent d’échanger la profondeur contre la vitesse pour chaque tâche.
Quels types d’entrées et quels outils prend-il en charge ?
Entrée multimodale — texte, image, vidéo, audio et PDF — avec sortie texte, sur un contexte d’entrée de 1M de tokens et une sortie de 64K. L’utilisation d’outils inclut l’appel de fonctions, la sortie structurée, l’ancrage dans la recherche et l’exécution de code. La date limite des connaissances est janvier 2025.
Comment se compare-t-il à Gemini 2.5 Flash ?
Il surpasse Gemini 2.5 Flash sur des benchmarks clés, atteignant 86.9% sur GPQA Diamond, 76.8% sur MMMU-Pro et 72.0% sur la génération de code.
Comment est-il facturé sur Velokey ?
La zone de tarification de cette page affiche le prix Velokey actuel, facturé selon les tokens d’entrée et de sortie avec une remise sur le prix catalogue. Une seule clé API couvre Gemini 3.1 Flash ainsi que d’autres modèles.
Commencez avec Gemini 3.1 Flash Lite Preview dès aujourd'hui
Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.