Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash ist Googles kosteneffizientestes Gemini 3-Modell (Preview), mit starker Intelligenz, hohem Durchsatz und multimodaler Eingabe. Greifen Sie über Velokeys einheitlichen Endpunkt darauf zu – mit Preisen unter dem Listenpreis.
Anwendungsfälle
Coding & UI-Generierung · Übersetzung & Datenlabeling im großen Maßstab
Eingabe
Text, Bild
Ausgabe
Text
Abrechnung
Pro Token
Starten Sie eine Unterhaltung
Geben Sie unten eine Nachricht ein, um zu beginnen
Registrieren und $0.5 Startguthaben erhalten — rund 20 Gratis-Bilder
Preisdetails
Transparente nutzungsbasierte Preise ohne versteckte Gebühren.
Detaillierte Preise
Nutzungsbasierte Preisübersicht
| Spezifikation | Preis | Offiziell | Ersparnis |
|---|---|---|---|
| Input/1M tokens | 0.2 Credits≈$0.2 | 0.25 Credits | -20% |
| Output/1M tokens | 1.2 Credits≈$1.2 | 1.5 Credits | -20% |
| Cache Read/1M tokens | 0.02 Credits≈$0.02 | 0.025 Credits | -20% |
Abrechnungsregeln
- Der Ausgabepreis variiert je nach Modell, Auflösung, Qualität, Dauer oder Token-Verbrauch.
- Hochgeladene Referenzdateien können bei unterstützten Modellen separat berechnet werden.
- Zusatzfunktionen wie Web- oder Bildsuche können pro Anfrage berechnet werden.
- Tokenbasierte Modelle werden nach Eingabe- und Ausgabe-Tokens abgerechnet.
- Ist die primäre Route nicht verfügbar, kann Velokey nach Möglichkeit automatisch auf eine stabile Ausweichroute umschalten.
- Die Nutzung ist Pay-as-you-go mit transparentem Credit-Abzug.
* Die endgültigen Kosten hängen vom generierten Ergebnis ab.
Verwandte Modelle
Entdecken Sie weitere Modelle derselben Familie.
- Google20% sparen
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- Google20% sparen
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- Google20% sparen
Gemini 3 Flash Preview
Gemini 3 Flash brings Pro-grade reasoning at Flash-level latency and cost — strong coding (SWE-bench 78%), 3x faster than 2.5 Pro, and multimodal understanding.
- Google20% sparen
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
Erschwingliche Gemini 3.1 Flash API
Greifen Sie auf Google DeepMinds kosteneffizientestes Gemini 3-Modell auf Velokey zu — hoher Durchsatz, flexible Reasoning-Stufen und 1M-Token-multimodale Eingabe, mit einem einheitlichen Endpunkt und Preisen unter dem Listenpreis für Produktions-Apps.
Lernen Sie Gemini 3.1 Flash und seinen API-Zugriff kennen
Gemini 3.1 Flash ist Google DeepMinds kosteneffizientestes Modell der Gemini 3-Serie (Preview). Es kombiniert starke Intelligenz mit hohem Durchsatz bei 363 Token/Sekunde und niedriger Latenz, ergänzt flexible Reasoning-Stufen, sodass Sie Rechenleistung an die Komplexität jeder Aufgabe anpassen können, und akzeptiert multimodale Eingaben — Text, Bild, Video, Audio und PDF — über ein 1M-Token-Kontextfenster mit Function Calling, strukturierter Ausgabe, Search Grounding und Codeausführung. Es übertrifft Gemini 2.5 Flash bei GPQA Diamond, MMMU-Pro und Codegenerierung. Velokey bietet eine erschwingliche, einfach zu integrierende Gemini 3.1 Flash API: einen einheitlichen Chat-Endpunkt, einen klaren Anfrageablauf und Preise unter dem Listenpreis für Produktionssysteme, Pipelines mit hohem Volumen und Echtzeitanwendungen.
Am kosteneffizientesten in der Gemini 3-Serie
Das kosteneffizienteste Modell der Gemini 3-Serie, das starke Intelligenz mit einem niedrigen Preis kombiniert, sodass Workloads mit hohem Volumen erschwinglich bleiben, ohne auf Qualität zu verzichten.
Dokumentation anzeigen →
Hohe Geschwindigkeit und niedrige Latenz
Generiert rund 363 Token/Sekunde bei niedriger Latenz und hält Aufgaben mit hohem Volumen sowie latenzkritische Aufgaben reaktionsschnell — ideal für Echtzeit-Content-Generierung in großem Maßstab.
Dokumentation anzeigen →
Flexible Reasoning-Stufen
Regeln Sie die Reasoning-Tiefe für jede Anfrage hoch oder herunter, um unterschiedliche Aufgabenkomplexität abzudecken — günstig und sofort für einfache Arbeit, tiefer, wenn eine Aufgabe es wirklich erfordert.
Dokumentation anzeigen →
1M-Token-multimodale Eingabe mit Tools
Akzeptiert Text, Bild, Video, Audio und PDF über einen 1M-Token-Eingabekontext, mit Function Calling, strukturierter Ausgabe, Search Grounding und Codeausführung für echte Agenten-Workflows.
Dokumentation anzeigen →
So stellen Sie die Gemini 3.1 Flash API auf Velokey bereit
Starten Sie mit nur wenigen Schritten.
Registrieren und API Key erhalten
Melden Sie sich in der Velokey-Konsole an, um einen API Key zu generieren, der jede an gemini-3-1-flash gesendete Anfrage authentifiziert.
Anfrageparameter konfigurieren
Setzen Sie das Modell auf gemini-3-1-flash und übermitteln Sie Nachrichten. Wählen Sie eine flexible Reasoning-Stufe, um Tiefe gegen Geschwindigkeit abzuwägen, und hängen Sie bei Bedarf Text-, Bild-, Video-, Audio- oder PDF-Eingaben an.
Integrieren und Aufrufe starten
Senden Sie Anfragen an Velokeys einheitlichen /v1/chat/completions-Endpunkt, um Assistenten, Pipelines mit hohem Volumen und Echtzeit-Apps zu betreiben, wobei die Nutzung in einer Konsole verwaltet wird.
Praxisnahe Anwendungsfälle für Gemini 3.1 Flash
Von Coding bis zu Datenarbeit im großen Maßstab, für viele Szenarien mit hohem Volumen.
Coding & UI-Generierung
Starke Codegenerierungsqualität mit niedriger Latenz — geeignet für Coding-Assistenten und die Generierung von UI in großem Maßstab, wo sowohl Geschwindigkeit als auch Kosten wichtig sind.
Übersetzung im großen Maßstab
Kosteneffizient und schnell — geeignet für Übersetzungspipelines mit hohem Volumen, die kontinuierlich große Content-Batches verarbeiten.
Datenlabeling im großen Maßstab
Niedrige Kosten pro Aufruf und hoher Durchsatz — geeignet für das Labeling und Annotieren großer Datensätze über lang laufende Jobs hinweg.
Echtzeit-Content-Generierung
363 Token/Sekunde mit niedriger Latenz — geeignet für Echtzeit-Content-Generierung in Live-Produkten und interaktiven Erlebnissen.
Latenzkritisches Reasoning
Flexible Reasoning-Stufen ermöglichen es Ihnen, Antworten schnell zu halten und dennoch bei Bedarf Reasoning zu nutzen — geeignet für latenzkritische Assistenten.
Multimodales Verständnis
Verarbeitet Text-, Bild-, Video-, Audio- und PDF-Eingaben über einen 1M-Token-Kontext — geeignet für die Analyse und Zusammenfassung von Mixed-Media-Inhalten.
Warum Velokey für Gemini 3.1 Flash wählen
Rabatt auf den Listenpreis
Nutzen Sie Gemini 3.1 Flash zu einem niedrigeren Preis auf Velokey — Pay-as-you-go ohne erzwungenes Abonnement, damit Workloads mit hohem Volumen erschwinglich bleiben.
Einheitliche API-Schnittstelle
Ein API Key bietet Zugriff auf Gemini 3.1 Flash und andere Modelle — kein Jonglieren mit mehreren Konten und Keys, was die Integration vereinfacht.
Vollständige Dokumentation und Integrationsanleitung
Endpunktreferenzen, Parameterdetails und Beispiele helfen Ihnen, Reasoning-Stufen, multimodale Eingaben und Tool-Nutzung schnell einzubinden.
Stabil und hochverfügbar
Automatisches Failover und stabile Fallback-Routen erhalten die Verfügbarkeit, wenn die primäre Route ausfällt, und halten die Produktion zuverlässig.
API-Referenz
Vollständige API-Aufrufbeispiele und Parameterbeschreibungen
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3.1-flash-lite-preview",
"created": 1234567890,
"data": { ... }
}Gemini 3.1 Flash API FAQ
Wofür ist Gemini 3.1 Flash am besten geeignet?
Es ist das kosteneffizienteste Modell der Gemini 3-Serie (Preview), entwickelt für Aufgaben mit hohem Volumen, die Effizienz plus Intelligenz benötigen — Coding und UI-Generierung, Übersetzung, Datenlabeling im großen Maßstab, Echtzeit-Content-Generierung und latenzkritisches Reasoning.
Wie schnell ist es?
Es generiert rund 363 Token/Sekunde bei niedriger Latenz und eignet sich damit gut für Workloads mit hohem Volumen und latenzkritische Workloads. Flexible Reasoning-Stufen ermöglichen es Ihnen, Tiefe pro Aufgabe gegen Geschwindigkeit einzutauschen.
Welche Eingaben und Tools unterstützt es?
Multimodale Eingabe — Text, Bild, Video, Audio und PDF — mit Textausgabe, über einen 1M-Token-Eingabekontext und 64K Ausgabe. Die Tool-Nutzung umfasst Function Calling, strukturierte Ausgabe, Search Grounding und Codeausführung. Der Wissensstichtag ist Januar 2025.
Wie schneidet es im Vergleich zu Gemini 2.5 Flash ab?
Es übertrifft Gemini 2.5 Flash bei wichtigen Benchmarks und erreicht 86.9% bei GPQA Diamond, 76.8% bei MMMU-Pro und 72.0% bei Codegenerierung.
Wie wird es auf Velokey abgerechnet?
Der Preisbereich dieser Seite zeigt den aktuellen Velokey-Preis, abgerechnet nach Eingabe- und Ausgabe-Token mit einem Rabatt auf den Listenpreis. Ein API Key deckt Gemini 3.1 Flash zusammen mit anderen Modellen ab.
Starten Sie noch heute mit Gemini 3.1 Flash Lite Preview
Greifen Sie mit einem einzigen API-Schlüssel über Velokey auf günstige, stabile KI-Modelle zu.