Velokey

Gemini 3.1 Flash Lite Preview

GoogleChatin 0.2 · out 1.2 Créditos / 1M tokens≈$0.2 / $1.2Disponible

Gemini 3.1 Flash es el modelo Gemini 3 más rentable de Google (preview), con inteligencia sólida, alto rendimiento y entrada multimodal. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.

El más rentable de Gemini 3363 tokens por segundoNiveles de razonamiento flexiblesEntrada multimodal de 1M de tokens

Casos de uso

Programación y generación de UI · Traducción y etiquetado de datos a escala

Entrada

Texto, imagen

Salida

Texto

Facturación

Por token

0.7
02
2048
2568192
gemini-3.1-flash-lite-preview

Inicia una conversación

Escribe un mensaje abajo para comenzar

Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis

Detalles de precio

Precios transparentes por uso, sin costes ocultos.

Precios detallados

Desglose de precios por uso

EspecificaciónPrecioOficialAhorro
Input/1M tokens0.2 Créditos≈$0.20.25 Créditos-20%
Output/1M tokens1.2 Créditos≈$1.21.5 Créditos-20%
Cache Read/1M tokens0.02 Créditos≈$0.020.025 Créditos-20%

Reglas de facturacion

  • El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
  • Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
  • Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
  • Los modelos basados en tokens se cobran por tokens de entrada y salida.
  • Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
  • El uso es de pago por consumo con deduccion transparente de creditos.

* El coste final depende del resultado generado.

API asequible de Gemini 3.1 Flash

Accede al modelo Gemini 3 más rentable de Google DeepMind en Velokey: alto rendimiento, niveles de razonamiento flexibles y entrada multimodal de 1M de tokens, con un endpoint unificado y precios por debajo de lista para apps en producción.

Conoce Gemini 3.1 Flash y su acceso por API

Gemini 3.1 Flash es el modelo más rentable de Google DeepMind en la serie Gemini 3 (versión preliminar). Combina una inteligencia sólida con un alto rendimiento de 363 tokens por segundo y baja latencia, añade niveles de razonamiento flexibles para que ajustes el cómputo a la complejidad de cada tarea y admite entrada multimodal —texto, imagen, vídeo, audio y PDF— con una ventana de contexto de 1M de tokens, además de llamadas a funciones, salida estructurada, anclaje de búsqueda y ejecución de código. Supera a Gemini 2.5 Flash en GPQA Diamond, MMMU-Pro y generación de código. Velokey ofrece una API de Gemini 3.1 Flash asequible y fácil de integrar: un endpoint de chat unificado, un flujo de solicitud claro y precios por debajo de lista para sistemas en producción, canalizaciones de alto volumen y aplicaciones en tiempo real.

El más rentable de la serie Gemini 3

El modelo más rentable de la serie Gemini 3, que combina una inteligencia sólida con un precio bajo para que las cargas de alto volumen sigan siendo asequibles sin renunciar a la calidad.

Ver documentación
El más rentable de la serie Gemini 3

Alta velocidad y baja latencia

Genera alrededor de 363 tokens por segundo con baja latencia, manteniendo ágiles las tareas de alto volumen y sensibles a la latencia: ideal para la generación de contenido en tiempo real a escala.

Ver documentación
Alta velocidad y baja latencia

Niveles de razonamiento flexibles

Sube o baja la profundidad de razonamiento en cada solicitud para adaptarte a la complejidad variable: barato e instantáneo para lo simple, más profundo cuando una tarea realmente lo necesita.

Ver documentación
Niveles de razonamiento flexibles

Entrada multimodal de 1M de tokens con herramientas

Admite texto, imagen, vídeo, audio y PDF en un contexto de entrada de 1M de tokens, con llamadas a funciones, salida estructurada, anclaje de búsqueda y ejecución de código para flujos de agentes reales.

Ver documentación
Entrada multimodal de 1M de tokens con herramientas

Cómo desplegar la API de Gemini 3.1 Flash en Velokey

Empieza con solo unos pasos.

1

Regístrate y obtén una API Key

Inicia sesión en la consola de Velokey para generar una API Key que autentica cada solicitud enviada a gemini-3-1-flash.

2

Configura los parámetros de la solicitud

Define model como gemini-3-1-flash y envía los mensajes. Elige un nivel de razonamiento flexible para equilibrar profundidad y velocidad, y adjunta entrada de texto, imagen, vídeo, audio o PDF según sea necesario.

3

Integra y empieza a llamar

Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para potenciar asistentes, canalizaciones de alto volumen y apps en tiempo real, con el uso gestionado en una sola consola.

Casos de uso reales de Gemini 3.1 Flash

Desde la programación hasta el trabajo con datos a gran escala, cubriendo muchos escenarios de alto volumen.

Programación y generación de UI

Sólida calidad de generación de código con baja latencia: ideal para asistentes de programación y generación de UI a escala donde importan velocidad y coste.

Traducción a escala

Rentable y rápido: ideal para canalizaciones de traducción de alto volumen que procesan grandes lotes de contenido de forma continua.

Etiquetado de datos a escala

Bajo coste por llamada y alto rendimiento: ideal para etiquetar y anotar grandes conjuntos de datos en trabajos de larga duración.

Generación de contenido en tiempo real

363 tokens por segundo con baja latencia: ideal para la generación de contenido en tiempo real en productos en vivo y experiencias interactivas.

Razonamiento sensible a la latencia

Los niveles de razonamiento flexibles mantienen las respuestas rápidas mientras razonan cuando hace falta: ideal para asistentes sensibles a la latencia.

Comprensión multimodal

Admite entrada de texto, imagen, vídeo, audio y PDF en un contexto de 1M de tokens: ideal para analizar y resumir contenido multimedia mixto.

Por qué elegir Velokey para Gemini 3.1 Flash

Descuento sobre el precio de lista

Llama a Gemini 3.1 Flash a un precio más bajo en Velokey: pago por uso sin suscripción obligatoria, manteniendo asequibles las cargas de alto volumen.

Interfaz de API unificada

Una sola API Key accede a Gemini 3.1 Flash y a otros modelos: sin gestionar varias cuentas y claves, simplificando la integración.

Documentación e integración completas

Referencias de endpoints, detalles de parámetros y ejemplos te ayudan a conectar rápidamente niveles de razonamiento, entrada multimodal y uso de herramientas.

Estable y de alta disponibilidad

La conmutación por error automática y las rutas de reserva estables mantienen la disponibilidad cuando la ruta principal cae, manteniendo la producción fiable.

Referencia API

Ejemplos completos de llamada API y descripcion de parametros

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-lite-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3.1-flash-lite-preview",
  "created": 1234567890,
  "data": { ... }
}

Preguntas frecuentes sobre la API de Gemini 3.1 Flash

¿Para qué es mejor Gemini 3.1 Flash?

Es el modelo más rentable de la serie Gemini 3 (versión preliminar), creado para tareas de alto volumen que necesitan eficiencia más inteligencia: programación y generación de UI, traducción, etiquetado de datos a escala, generación de contenido en tiempo real y razonamiento sensible a la latencia.

¿Qué tan rápido es?

Genera alrededor de 363 tokens por segundo con baja latencia, lo que lo hace muy adecuado para cargas de alto volumen y sensibles a la latencia. Los niveles de razonamiento flexibles te permiten cambiar profundidad por velocidad en cada tarea.

¿Qué entradas y herramientas admite?

Entrada multimodal —texto, imagen, vídeo, audio y PDF— con salida de texto, sobre un contexto de entrada de 1M de tokens y 64K de salida. El uso de herramientas incluye llamadas a funciones, salida estructurada, anclaje de búsqueda y ejecución de código. El corte de conocimiento es enero de 2025.

¿Cómo se compara con Gemini 2.5 Flash?

Supera a Gemini 2.5 Flash en pruebas clave, alcanzando un 86,9% en GPQA Diamond, un 76,8% en MMMU-Pro y un 72,0% en generación de código.

¿Cómo se factura en Velokey?

El área de precios de esta página muestra el precio actual de Velokey, facturado por tokens de entrada y salida con un descuento sobre el precio de lista. Una sola API key cubre Gemini 3.1 Flash junto con otros modelos.

Empieza a construir con Gemini 3.1 Flash Lite Preview

Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.