Velokey

Gemini 3.1 Flash Lite Preview

GoogleChatin 0.2 · out 1.2 Crédits / 1M tokens≈$0.2 / $1.2Disponible

Gemini 3.1 Flash est le modèle Gemini 3 le plus rentable de Google (preview), avec une intelligence solide, un débit élevé et une entrée multimodale. Accédez-y via le point de terminaison unifié de Velokey avec une tarification inférieure au prix catalogue.

Le plus rentable de Gemini 3363 tokens/secondeNiveaux de raisonnement flexiblesEntrée multimodale de 1M de tokens

Cas d'usage

Codage et génération d’UI · Traduction et étiquetage de données à grande échelle

Entrée

Texte, image

Sortie

Texte

Facturation

Par token

0.7
02
2048
2568192
gemini-3.1-flash-lite-preview

Démarrer une conversation

Saisissez un message ci-dessous pour commencer

Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites

Détails des tarifs

Tarification transparente à l'usage, sans frais cachés.

Tarifs détaillés

Détail des tarifs à l'usage

SpécificationPrixOfficielÉconomie
Input/1M tokens0.2 crédits≈$0.20.25 crédits-20%
Output/1M tokens1.2 crédits≈$1.21.5 crédits-20%
Cache Read/1M tokens0.02 crédits≈$0.020.025 crédits-20%

Règles de facturation

  • Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
  • Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
  • Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
  • Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
  • Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
  • L'utilisation est à la demande, avec une déduction transparente des crédits.

* Le coût final dépend du résultat généré.

API Gemini 3.1 Flash abordable

Accédez au modèle Gemini 3 le plus rentable de Google DeepMind sur Velokey — haut débit, niveaux de raisonnement flexibles et entrée multimodale de 1M de tokens, avec un point de terminaison unifié et une tarification inférieure au prix catalogue pour les applications de production.

Découvrez Gemini 3.1 Flash et son accès API

Gemini 3.1 Flash est le modèle le plus rentable de Google DeepMind dans la série Gemini 3 (preview). Il associe une intelligence solide à un haut débit de 363 tokens/seconde et une faible latence, ajoute des niveaux de raisonnement flexibles afin que vous puissiez adapter le calcul à la complexité de chaque tâche, et accepte les entrées multimodales — texte, image, vidéo, audio et PDF — sur une fenêtre de contexte de 1M de tokens avec appel de fonctions, sortie structurée, ancrage dans la recherche et exécution de code. Il surpasse Gemini 2.5 Flash sur GPQA Diamond, MMMU-Pro et la génération de code. Velokey fournit une API Gemini 3.1 Flash abordable et facile à intégrer : un point de terminaison de chat unifié, un flux de requête clair et une tarification inférieure au prix catalogue pour les systèmes de production, les pipelines à haut volume et les applications en temps réel.

Le plus rentable de la série Gemini 3

Le modèle le plus rentable de la série Gemini 3, associant une intelligence solide à un prix bas afin que les charges de travail à haut volume restent abordables sans sacrifier la qualité.

Voir la documentation
Le plus rentable de la série Gemini 3

Grande vitesse et faible latence

Génère environ 363 tokens/seconde avec une faible latence, maintenant les tâches à haut volume et sensibles à la latence réactives — idéal pour la génération de contenu en temps réel à grande échelle.

Voir la documentation
Grande vitesse et faible latence

Niveaux de raisonnement flexibles

Augmentez ou réduisez la profondeur de raisonnement pour chaque requête afin de correspondre à la complexité variable des tâches — économique et instantané pour les travaux simples, plus approfondi lorsqu’une tâche en a vraiment besoin.

Voir la documentation
Niveaux de raisonnement flexibles

Entrée multimodale de 1M de tokens avec outils

Accepte texte, image, vidéo, audio et PDF sur un contexte d’entrée de 1M de tokens, avec appel de fonctions, sortie structurée, ancrage dans la recherche et exécution de code pour de vrais workflows d’agents.

Voir la documentation
Entrée multimodale de 1M de tokens avec outils

Comment déployer l’API Gemini 3.1 Flash sur Velokey

Démarrez en seulement quelques étapes.

1

Inscrivez-vous et obtenez une clé API

Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à gemini-3-1-flash.

2

Configurez les paramètres de requête

Définissez le modèle sur gemini-3-1-flash et soumettez des messages. Choisissez un niveau de raisonnement flexible pour équilibrer la profondeur et la vitesse, et joignez une entrée texte, image, vidéo, audio ou PDF selon vos besoins.

3

Intégrez et commencez à appeler

Envoyez des requêtes au point de terminaison unifié /v1/chat/completions de Velokey pour alimenter des assistants, des pipelines à haut volume et des applications en temps réel, avec l’utilisation gérée dans une seule console.

Cas d’utilisation concrets pour Gemini 3.1 Flash

Du codage au travail de données à grande échelle, couvrant de nombreux scénarios à haut volume.

Codage et génération d’UI

Forte qualité de génération de code avec faible latence — adapté aux assistants de codage et à la génération d’UI à grande échelle lorsque la vitesse et le coût comptent tous les deux.

Traduction à grande échelle

Rentable et rapide — adapté aux pipelines de traduction à haut volume qui traitent en continu de grands lots de contenu.

Étiquetage de données à grande échelle

Faible coût par appel et haut débit — adapté à l’étiquetage et à l’annotation de grands jeux de données sur des tâches de longue durée.

Génération de contenu en temps réel

363 tokens/seconde avec faible latence — adapté à la génération de contenu en temps réel dans les produits live et les expériences interactives.

Raisonnement sensible à la latence

Les niveaux de raisonnement flexibles vous permettent de garder des réponses rapides tout en raisonnant lorsque c’est nécessaire — adapté aux assistants sensibles à la latence.

Compréhension multimodale

Prend des entrées texte, image, vidéo, audio et PDF sur un contexte de 1M de tokens — adapté à l’analyse et au résumé de contenu multimédia mixte.

Pourquoi choisir Velokey pour Gemini 3.1 Flash

Remise sur le prix catalogue

Appelez Gemini 3.1 Flash à un prix plus bas sur Velokey — paiement à l’usage sans abonnement imposé, pour maintenir les charges de travail à haut volume abordables.

Interface API unifiée

Une seule clé API permet d’accéder à Gemini 3.1 Flash et à d’autres modèles — plus besoin de jongler avec plusieurs comptes et clés, ce qui simplifie l’intégration.

Documentation complète et conseils d’intégration

Des références de points de terminaison, des détails de paramètres et des exemples vous aident à intégrer rapidement les niveaux de raisonnement, l’entrée multimodale et l’utilisation d’outils.

Stable et hautement disponible

Le basculement automatique et des routes de secours stables maintiennent la disponibilité lorsque la route principale est indisponible, gardant la production fiable.

Référence API

Exemples complets d'appels API et description des paramètres

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-lite-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3.1-flash-lite-preview",
  "created": 1234567890,
  "data": { ... }
}

FAQ de l’API Gemini 3.1 Flash

À quoi Gemini 3.1 Flash est-il le mieux adapté ?

C’est le modèle le plus rentable de la série Gemini 3 (preview), conçu pour les tâches à haut volume qui nécessitent efficacité et intelligence — codage et génération d’UI, traduction, étiquetage de données à grande échelle, génération de contenu en temps réel et raisonnement sensible à la latence.

Quelle est sa vitesse ?

Il génère environ 363 tokens/seconde avec une faible latence, ce qui le rend bien adapté aux charges de travail à haut volume et sensibles à la latence. Les niveaux de raisonnement flexibles vous permettent d’échanger la profondeur contre la vitesse pour chaque tâche.

Quels types d’entrées et quels outils prend-il en charge ?

Entrée multimodale — texte, image, vidéo, audio et PDF — avec sortie texte, sur un contexte d’entrée de 1M de tokens et une sortie de 64K. L’utilisation d’outils inclut l’appel de fonctions, la sortie structurée, l’ancrage dans la recherche et l’exécution de code. La date limite des connaissances est janvier 2025.

Comment se compare-t-il à Gemini 2.5 Flash ?

Il surpasse Gemini 2.5 Flash sur des benchmarks clés, atteignant 86.9% sur GPQA Diamond, 76.8% sur MMMU-Pro et 72.0% sur la génération de code.

Comment est-il facturé sur Velokey ?

La zone de tarification de cette page affiche le prix Velokey actuel, facturé selon les tokens d’entrée et de sortie avec une remise sur le prix catalogue. Une seule clé API couvre Gemini 3.1 Flash ainsi que d’autres modèles.

Commencez avec Gemini 3.1 Flash Lite Preview dès aujourd'hui

Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.