Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash es el modelo Gemini 3 más rentable de Google (preview), con inteligencia sólida, alto rendimiento y entrada multimodal. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.
Casos de uso
Programación y generación de UI · Traducción y etiquetado de datos a escala
Entrada
Texto, imagen
Salida
Texto
Facturación
Por token
Inicia una conversación
Escribe un mensaje abajo para comenzar
Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis
Detalles de precio
Precios transparentes por uso, sin costes ocultos.
Precios detallados
Desglose de precios por uso
| Especificación | Precio | Oficial | Ahorro |
|---|---|---|---|
| Input/1M tokens | 0.2 Créditos≈$0.2 | 0.25 Créditos | -20% |
| Output/1M tokens | 1.2 Créditos≈$1.2 | 1.5 Créditos | -20% |
| Cache Read/1M tokens | 0.02 Créditos≈$0.02 | 0.025 Créditos | -20% |
Reglas de facturacion
- El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
- Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
- Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
- Los modelos basados en tokens se cobran por tokens de entrada y salida.
- Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
- El uso es de pago por consumo con deduccion transparente de creditos.
* El coste final depende del resultado generado.
Modelos relacionados
Explora otros modelos de la misma familia.
- GoogleAhorra 20%
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- GoogleAhorra 20%
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- GoogleAhorra 20%
Gemini 3 Flash Preview
Gemini 3 Flash brings Pro-grade reasoning at Flash-level latency and cost — strong coding (SWE-bench 78%), 3x faster than 2.5 Pro, and multimodal understanding.
- GoogleAhorra 20%
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
API asequible de Gemini 3.1 Flash
Accede al modelo Gemini 3 más rentable de Google DeepMind en Velokey: alto rendimiento, niveles de razonamiento flexibles y entrada multimodal de 1M de tokens, con un endpoint unificado y precios por debajo de lista para apps en producción.
Conoce Gemini 3.1 Flash y su acceso por API
Gemini 3.1 Flash es el modelo más rentable de Google DeepMind en la serie Gemini 3 (versión preliminar). Combina una inteligencia sólida con un alto rendimiento de 363 tokens por segundo y baja latencia, añade niveles de razonamiento flexibles para que ajustes el cómputo a la complejidad de cada tarea y admite entrada multimodal —texto, imagen, vídeo, audio y PDF— con una ventana de contexto de 1M de tokens, además de llamadas a funciones, salida estructurada, anclaje de búsqueda y ejecución de código. Supera a Gemini 2.5 Flash en GPQA Diamond, MMMU-Pro y generación de código. Velokey ofrece una API de Gemini 3.1 Flash asequible y fácil de integrar: un endpoint de chat unificado, un flujo de solicitud claro y precios por debajo de lista para sistemas en producción, canalizaciones de alto volumen y aplicaciones en tiempo real.
El más rentable de la serie Gemini 3
El modelo más rentable de la serie Gemini 3, que combina una inteligencia sólida con un precio bajo para que las cargas de alto volumen sigan siendo asequibles sin renunciar a la calidad.
Ver documentación →
Alta velocidad y baja latencia
Genera alrededor de 363 tokens por segundo con baja latencia, manteniendo ágiles las tareas de alto volumen y sensibles a la latencia: ideal para la generación de contenido en tiempo real a escala.
Ver documentación →
Niveles de razonamiento flexibles
Sube o baja la profundidad de razonamiento en cada solicitud para adaptarte a la complejidad variable: barato e instantáneo para lo simple, más profundo cuando una tarea realmente lo necesita.
Ver documentación →
Entrada multimodal de 1M de tokens con herramientas
Admite texto, imagen, vídeo, audio y PDF en un contexto de entrada de 1M de tokens, con llamadas a funciones, salida estructurada, anclaje de búsqueda y ejecución de código para flujos de agentes reales.
Ver documentación →
Cómo desplegar la API de Gemini 3.1 Flash en Velokey
Empieza con solo unos pasos.
Regístrate y obtén una API Key
Inicia sesión en la consola de Velokey para generar una API Key que autentica cada solicitud enviada a gemini-3-1-flash.
Configura los parámetros de la solicitud
Define model como gemini-3-1-flash y envía los mensajes. Elige un nivel de razonamiento flexible para equilibrar profundidad y velocidad, y adjunta entrada de texto, imagen, vídeo, audio o PDF según sea necesario.
Integra y empieza a llamar
Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para potenciar asistentes, canalizaciones de alto volumen y apps en tiempo real, con el uso gestionado en una sola consola.
Casos de uso reales de Gemini 3.1 Flash
Desde la programación hasta el trabajo con datos a gran escala, cubriendo muchos escenarios de alto volumen.
Programación y generación de UI
Sólida calidad de generación de código con baja latencia: ideal para asistentes de programación y generación de UI a escala donde importan velocidad y coste.
Traducción a escala
Rentable y rápido: ideal para canalizaciones de traducción de alto volumen que procesan grandes lotes de contenido de forma continua.
Etiquetado de datos a escala
Bajo coste por llamada y alto rendimiento: ideal para etiquetar y anotar grandes conjuntos de datos en trabajos de larga duración.
Generación de contenido en tiempo real
363 tokens por segundo con baja latencia: ideal para la generación de contenido en tiempo real en productos en vivo y experiencias interactivas.
Razonamiento sensible a la latencia
Los niveles de razonamiento flexibles mantienen las respuestas rápidas mientras razonan cuando hace falta: ideal para asistentes sensibles a la latencia.
Comprensión multimodal
Admite entrada de texto, imagen, vídeo, audio y PDF en un contexto de 1M de tokens: ideal para analizar y resumir contenido multimedia mixto.
Por qué elegir Velokey para Gemini 3.1 Flash
Descuento sobre el precio de lista
Llama a Gemini 3.1 Flash a un precio más bajo en Velokey: pago por uso sin suscripción obligatoria, manteniendo asequibles las cargas de alto volumen.
Interfaz de API unificada
Una sola API Key accede a Gemini 3.1 Flash y a otros modelos: sin gestionar varias cuentas y claves, simplificando la integración.
Documentación e integración completas
Referencias de endpoints, detalles de parámetros y ejemplos te ayudan a conectar rápidamente niveles de razonamiento, entrada multimodal y uso de herramientas.
Estable y de alta disponibilidad
La conmutación por error automática y las rutas de reserva estables mantienen la disponibilidad cuando la ruta principal cae, manteniendo la producción fiable.
Referencia API
Ejemplos completos de llamada API y descripcion de parametros
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3.1-flash-lite-preview",
"created": 1234567890,
"data": { ... }
}Preguntas frecuentes sobre la API de Gemini 3.1 Flash
¿Para qué es mejor Gemini 3.1 Flash?
Es el modelo más rentable de la serie Gemini 3 (versión preliminar), creado para tareas de alto volumen que necesitan eficiencia más inteligencia: programación y generación de UI, traducción, etiquetado de datos a escala, generación de contenido en tiempo real y razonamiento sensible a la latencia.
¿Qué tan rápido es?
Genera alrededor de 363 tokens por segundo con baja latencia, lo que lo hace muy adecuado para cargas de alto volumen y sensibles a la latencia. Los niveles de razonamiento flexibles te permiten cambiar profundidad por velocidad en cada tarea.
¿Qué entradas y herramientas admite?
Entrada multimodal —texto, imagen, vídeo, audio y PDF— con salida de texto, sobre un contexto de entrada de 1M de tokens y 64K de salida. El uso de herramientas incluye llamadas a funciones, salida estructurada, anclaje de búsqueda y ejecución de código. El corte de conocimiento es enero de 2025.
¿Cómo se compara con Gemini 2.5 Flash?
Supera a Gemini 2.5 Flash en pruebas clave, alcanzando un 86,9% en GPQA Diamond, un 76,8% en MMMU-Pro y un 72,0% en generación de código.
¿Cómo se factura en Velokey?
El área de precios de esta página muestra el precio actual de Velokey, facturado por tokens de entrada y salida con un descuento sobre el precio de lista. Una sola API key cubre Gemini 3.1 Flash junto con otros modelos.
Empieza a construir con Gemini 3.1 Flash Lite Preview
Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.