Velokey

Gemini 3.1 Flash Lite Preview

GoogleChatin 0.2 · out 1.2 Credits / 1M Tokens≈$0.2 / $1.2Verfügbar

Gemini 3.1 Flash ist Googles kosteneffizientestes Gemini 3-Modell (Preview), mit starker Intelligenz, hohem Durchsatz und multimodaler Eingabe. Greifen Sie über Velokeys einheitlichen Endpunkt darauf zu – mit Preisen unter dem Listenpreis.

Am kosteneffizientesten in Gemini 3363 Token/SekundeFlexible Reasoning-Stufen1M-Token-multimodale Eingabe

Anwendungsfälle

Coding & UI-Generierung · Übersetzung & Datenlabeling im großen Maßstab

Eingabe

Text, Bild

Ausgabe

Text

Abrechnung

Pro Token

0.7
02
2048
2568192
gemini-3.1-flash-lite-preview

Starten Sie eine Unterhaltung

Geben Sie unten eine Nachricht ein, um zu beginnen

Registrieren und $0.5 Startguthaben erhalten — rund 20 Gratis-Bilder

Preisdetails

Transparente nutzungsbasierte Preise ohne versteckte Gebühren.

Detaillierte Preise

Nutzungsbasierte Preisübersicht

SpezifikationPreisOffiziellErsparnis
Input/1M tokens0.2 Credits≈$0.20.25 Credits-20%
Output/1M tokens1.2 Credits≈$1.21.5 Credits-20%
Cache Read/1M tokens0.02 Credits≈$0.020.025 Credits-20%

Abrechnungsregeln

  • Der Ausgabepreis variiert je nach Modell, Auflösung, Qualität, Dauer oder Token-Verbrauch.
  • Hochgeladene Referenzdateien können bei unterstützten Modellen separat berechnet werden.
  • Zusatzfunktionen wie Web- oder Bildsuche können pro Anfrage berechnet werden.
  • Tokenbasierte Modelle werden nach Eingabe- und Ausgabe-Tokens abgerechnet.
  • Ist die primäre Route nicht verfügbar, kann Velokey nach Möglichkeit automatisch auf eine stabile Ausweichroute umschalten.
  • Die Nutzung ist Pay-as-you-go mit transparentem Credit-Abzug.

* Die endgültigen Kosten hängen vom generierten Ergebnis ab.

Erschwingliche Gemini 3.1 Flash API

Greifen Sie auf Google DeepMinds kosteneffizientestes Gemini 3-Modell auf Velokey zu — hoher Durchsatz, flexible Reasoning-Stufen und 1M-Token-multimodale Eingabe, mit einem einheitlichen Endpunkt und Preisen unter dem Listenpreis für Produktions-Apps.

Lernen Sie Gemini 3.1 Flash und seinen API-Zugriff kennen

Gemini 3.1 Flash ist Google DeepMinds kosteneffizientestes Modell der Gemini 3-Serie (Preview). Es kombiniert starke Intelligenz mit hohem Durchsatz bei 363 Token/Sekunde und niedriger Latenz, ergänzt flexible Reasoning-Stufen, sodass Sie Rechenleistung an die Komplexität jeder Aufgabe anpassen können, und akzeptiert multimodale Eingaben — Text, Bild, Video, Audio und PDF — über ein 1M-Token-Kontextfenster mit Function Calling, strukturierter Ausgabe, Search Grounding und Codeausführung. Es übertrifft Gemini 2.5 Flash bei GPQA Diamond, MMMU-Pro und Codegenerierung. Velokey bietet eine erschwingliche, einfach zu integrierende Gemini 3.1 Flash API: einen einheitlichen Chat-Endpunkt, einen klaren Anfrageablauf und Preise unter dem Listenpreis für Produktionssysteme, Pipelines mit hohem Volumen und Echtzeitanwendungen.

Am kosteneffizientesten in der Gemini 3-Serie

Das kosteneffizienteste Modell der Gemini 3-Serie, das starke Intelligenz mit einem niedrigen Preis kombiniert, sodass Workloads mit hohem Volumen erschwinglich bleiben, ohne auf Qualität zu verzichten.

Dokumentation anzeigen
Am kosteneffizientesten in der Gemini 3-Serie

Hohe Geschwindigkeit und niedrige Latenz

Generiert rund 363 Token/Sekunde bei niedriger Latenz und hält Aufgaben mit hohem Volumen sowie latenzkritische Aufgaben reaktionsschnell — ideal für Echtzeit-Content-Generierung in großem Maßstab.

Dokumentation anzeigen
Hohe Geschwindigkeit und niedrige Latenz

Flexible Reasoning-Stufen

Regeln Sie die Reasoning-Tiefe für jede Anfrage hoch oder herunter, um unterschiedliche Aufgabenkomplexität abzudecken — günstig und sofort für einfache Arbeit, tiefer, wenn eine Aufgabe es wirklich erfordert.

Dokumentation anzeigen
Flexible Reasoning-Stufen

1M-Token-multimodale Eingabe mit Tools

Akzeptiert Text, Bild, Video, Audio und PDF über einen 1M-Token-Eingabekontext, mit Function Calling, strukturierter Ausgabe, Search Grounding und Codeausführung für echte Agenten-Workflows.

Dokumentation anzeigen
1M-Token-multimodale Eingabe mit Tools

So stellen Sie die Gemini 3.1 Flash API auf Velokey bereit

Starten Sie mit nur wenigen Schritten.

1

Registrieren und API Key erhalten

Melden Sie sich in der Velokey-Konsole an, um einen API Key zu generieren, der jede an gemini-3-1-flash gesendete Anfrage authentifiziert.

2

Anfrageparameter konfigurieren

Setzen Sie das Modell auf gemini-3-1-flash und übermitteln Sie Nachrichten. Wählen Sie eine flexible Reasoning-Stufe, um Tiefe gegen Geschwindigkeit abzuwägen, und hängen Sie bei Bedarf Text-, Bild-, Video-, Audio- oder PDF-Eingaben an.

3

Integrieren und Aufrufe starten

Senden Sie Anfragen an Velokeys einheitlichen /v1/chat/completions-Endpunkt, um Assistenten, Pipelines mit hohem Volumen und Echtzeit-Apps zu betreiben, wobei die Nutzung in einer Konsole verwaltet wird.

Praxisnahe Anwendungsfälle für Gemini 3.1 Flash

Von Coding bis zu Datenarbeit im großen Maßstab, für viele Szenarien mit hohem Volumen.

Coding & UI-Generierung

Starke Codegenerierungsqualität mit niedriger Latenz — geeignet für Coding-Assistenten und die Generierung von UI in großem Maßstab, wo sowohl Geschwindigkeit als auch Kosten wichtig sind.

Übersetzung im großen Maßstab

Kosteneffizient und schnell — geeignet für Übersetzungspipelines mit hohem Volumen, die kontinuierlich große Content-Batches verarbeiten.

Datenlabeling im großen Maßstab

Niedrige Kosten pro Aufruf und hoher Durchsatz — geeignet für das Labeling und Annotieren großer Datensätze über lang laufende Jobs hinweg.

Echtzeit-Content-Generierung

363 Token/Sekunde mit niedriger Latenz — geeignet für Echtzeit-Content-Generierung in Live-Produkten und interaktiven Erlebnissen.

Latenzkritisches Reasoning

Flexible Reasoning-Stufen ermöglichen es Ihnen, Antworten schnell zu halten und dennoch bei Bedarf Reasoning zu nutzen — geeignet für latenzkritische Assistenten.

Multimodales Verständnis

Verarbeitet Text-, Bild-, Video-, Audio- und PDF-Eingaben über einen 1M-Token-Kontext — geeignet für die Analyse und Zusammenfassung von Mixed-Media-Inhalten.

Warum Velokey für Gemini 3.1 Flash wählen

Rabatt auf den Listenpreis

Nutzen Sie Gemini 3.1 Flash zu einem niedrigeren Preis auf Velokey — Pay-as-you-go ohne erzwungenes Abonnement, damit Workloads mit hohem Volumen erschwinglich bleiben.

Einheitliche API-Schnittstelle

Ein API Key bietet Zugriff auf Gemini 3.1 Flash und andere Modelle — kein Jonglieren mit mehreren Konten und Keys, was die Integration vereinfacht.

Vollständige Dokumentation und Integrationsanleitung

Endpunktreferenzen, Parameterdetails und Beispiele helfen Ihnen, Reasoning-Stufen, multimodale Eingaben und Tool-Nutzung schnell einzubinden.

Stabil und hochverfügbar

Automatisches Failover und stabile Fallback-Routen erhalten die Verfügbarkeit, wenn die primäre Route ausfällt, und halten die Produktion zuverlässig.

API-Referenz

Vollständige API-Aufrufbeispiele und Parameterbeschreibungen

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-lite-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3.1-flash-lite-preview",
  "created": 1234567890,
  "data": { ... }
}

Gemini 3.1 Flash API FAQ

Wofür ist Gemini 3.1 Flash am besten geeignet?

Es ist das kosteneffizienteste Modell der Gemini 3-Serie (Preview), entwickelt für Aufgaben mit hohem Volumen, die Effizienz plus Intelligenz benötigen — Coding und UI-Generierung, Übersetzung, Datenlabeling im großen Maßstab, Echtzeit-Content-Generierung und latenzkritisches Reasoning.

Wie schnell ist es?

Es generiert rund 363 Token/Sekunde bei niedriger Latenz und eignet sich damit gut für Workloads mit hohem Volumen und latenzkritische Workloads. Flexible Reasoning-Stufen ermöglichen es Ihnen, Tiefe pro Aufgabe gegen Geschwindigkeit einzutauschen.

Welche Eingaben und Tools unterstützt es?

Multimodale Eingabe — Text, Bild, Video, Audio und PDF — mit Textausgabe, über einen 1M-Token-Eingabekontext und 64K Ausgabe. Die Tool-Nutzung umfasst Function Calling, strukturierte Ausgabe, Search Grounding und Codeausführung. Der Wissensstichtag ist Januar 2025.

Wie schneidet es im Vergleich zu Gemini 2.5 Flash ab?

Es übertrifft Gemini 2.5 Flash bei wichtigen Benchmarks und erreicht 86.9% bei GPQA Diamond, 76.8% bei MMMU-Pro und 72.0% bei Codegenerierung.

Wie wird es auf Velokey abgerechnet?

Der Preisbereich dieser Seite zeigt den aktuellen Velokey-Preis, abgerechnet nach Eingabe- und Ausgabe-Token mit einem Rabatt auf den Listenpreis. Ein API Key deckt Gemini 3.1 Flash zusammen mit anderen Modellen ab.

Starten Sie noch heute mit Gemini 3.1 Flash Lite Preview

Greifen Sie mit einem einzigen API-Schlüssel über Velokey auf günstige, stabile KI-Modelle zu.