Gemini 3 Flash Preview
Gemini 3 Flash es el modelo de Google DeepMind que une razonamiento de nivel Pro con la latencia, eficiencia y coste de la serie Flash. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.
Casos de uso
Programación agéntica y desarrollo iterativo · Apps interactivas y de consumo
Entrada
Texto, imagen
Salida
Texto
Facturación
Por token
Inicia una conversación
Escribe un mensaje abajo para comenzar
Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis
Detalles de precio
Precios transparentes por uso, sin costes ocultos.
Precios detallados
Desglose de precios por uso
| Especificación | Precio | Oficial | Ahorro |
|---|---|---|---|
| Input/1M tokens | 0.4 Créditos≈$0.4 | 0.5 Créditos | -20% |
| Output/1M tokens | 2.4 Créditos≈$2.4 | 3 Créditos | -20% |
| Cache Read/1M tokens | 0.04 Créditos≈$0.04 | 0.05 Créditos | -20% |
Reglas de facturacion
- El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
- Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
- Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
- Los modelos basados en tokens se cobran por tokens de entrada y salida.
- Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
- El uso es de pago por consumo con deduccion transparente de creditos.
* El coste final depende del resultado generado.
Modelos relacionados
Explora otros modelos de la misma familia.
- GoogleAhorra 20%
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- GoogleAhorra 20%
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- GoogleAhorra 20%
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash is Google's most cost-efficient model in the 3 series, with flexible reasoning, multimodal input and a 1M-token context for high-volume, low-latency tasks.
- GoogleAhorra 20%
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
API de Gemini 3 Flash asequible
Accede a Gemini 3 Flash de Google en Velokey: razonamiento de nivel Pro, programación de primer nivel y comprensión multimodal con latencia y coste de nivel Flash, con un endpoint unificado y precios por debajo de lista para apps de producción.
Conoce Gemini 3 Flash y su acceso por API
Gemini 3 Flash es el modelo de Google DeepMind lanzado el 17 de diciembre de 2025, que combina razonamiento de nivel Pro con la latencia, eficiencia y coste de la serie Flash. Une el razonamiento de frontera con la velocidad Flash: 90,4% en GPQA Diamond, 78% en SWE-bench Verified (superando tanto a la serie 2.5 como a Gemini 3 Pro) y 81,2% en MMMU Pro, comparable a Gemini 3 Pro. Funciona unas 3 veces más rápido que Gemini 2.5 Pro y usa alrededor de un 30% menos de tokens en tareas típicas. Velokey ofrece una API de Gemini 3 Flash asequible y fácil de integrar: un endpoint de chat unificado, un flujo claro y precios por debajo de lista mostrados en el panel de tu consola para sistemas de producción, pipelines de agentes y apps de consumo.
Razonamiento de nivel Pro a coste Flash
Une el razonamiento de frontera con la velocidad Flash: 90,4% en GPQA Diamond y 33,7% en Humanity's Last Exam (sin herramientas), superando a Gemini 2.5 Pro en varios benchmarks, todo con latencia y coste de nivel Flash.
Ver documentación →
Programación de primer nivel que supera a 3 Pro
Obtiene 78% en SWE-bench Verified, superando tanto a la serie Gemini 2.5 como a Gemini 3 Pro: apto para programación agéntica, uso de herramientas y bucles de desarrollo iterativo.
Ver documentación →
3x más rápido con 30% menos tokens
Funciona unas 3 veces más rápido que Gemini 2.5 Pro y usa en promedio alrededor de un 30% menos de tokens en tareas típicas, optimizado para flujos de baja latencia y alta frecuencia.
Ver documentación →
Comprensión multimodal en tiempo real
Maneja análisis de video, comprensión de imágenes y preguntas visuales, apto para escenarios multimodales en tiempo real como asistencia en juegos e iteración de diseño.
Ver documentación →
Cómo desplegar la API de Gemini 3 Flash en Velokey
Empieza en solo unos pasos.
Regístrate y obtén una API Key
Inicia sesión en la consola de Velokey para generar una API Key que autentica todas las solicitudes enviadas a Gemini 3 Flash.
Configura los parámetros de la solicitud
Establece model en gemini-3-flash y envía messages. Añade imágenes o video para tareas multimodales y mantén las solicitudes ligeras para aprovechar la latencia de nivel Flash.
Integra y empieza a llamar
Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para impulsar asistentes, agentes y apps interactivas, con el uso gestionado en una sola consola.
Casos de uso reales de Gemini 3 Flash
De la ingeniería a los productos interactivos, cubriendo muchos escenarios de baja latencia.
Programación agéntica y desarrollo iterativo
78% en SWE-bench Verified con latencia de nivel Flash: apto para programación agéntica, iteración rápida y bucles de desarrollo con herramientas.
Apps interactivas que necesitan respuestas rápidas
Baja latencia y bajo coste: apto para apps interactivas que necesitan respuestas rápidas y de alta frecuencia.
Análisis multimodal en tiempo real
Video, imagen y preguntas visuales: apto para escenarios en tiempo real como asistencia en juegos e iteración de diseño.
Tareas de razonamiento complejo
90,4% en GPQA Diamond y 33,7% en Humanity's Last Exam (sin herramientas): apto para problemas científicos y de razonamiento difíciles.
Flujos de alta frecuencia
Unas 3 veces más rápido que 2.5 Pro con ~30% menos de tokens: apto para pipelines de alto rendimiento y sensibles al coste.
Aplicaciones de consumo
Velocidad y coste de nivel Flash: apto para productos de consumo que sirven a muchos usuarios a escala.
Por qué elegir Velokey para Gemini 3 Flash
Descuento sobre el precio de lista
Llama a Gemini 3 Flash a un precio más bajo en Velokey: pago por uso sin suscripción obligatoria, reduciendo el coste inicial.
Interfaz de API unificada
Una sola API Key accede a Gemini 3 Flash y a otros modelos, sin gestionar varias cuentas y claves, simplificando la integración.
Documentación completa y ejemplos
Referencias de endpoints, detalles de parámetros y ejemplos multimodales te ayudan a integrar razonamiento, programación y visión rápidamente.
Estable y de alta disponibilidad
La conmutación por error automática y las rutas de respaldo estables mantienen la disponibilidad cuando la ruta principal falla, manteniendo la producción fiable.
Referencia API
Ejemplos completos de llamada API y descripcion de parametros
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3-flash-preview",
"created": 1234567890,
"data": { ... }
}Preguntas frecuentes de la API de Gemini 3 Flash
¿Qué hace diferente a Gemini 3 Flash?
Combina razonamiento de nivel Pro con la latencia, eficiencia y coste de la serie Flash, uniendo el razonamiento de frontera con la velocidad Flash. Alcanza 90,4% en GPQA Diamond, 78% en SWE-bench Verified y 81,2% en MMMU Pro, funcionando unas 3 veces más rápido que Gemini 2.5 Pro.
¿Cómo se compara su programación con Gemini 3 Pro?
En SWE-bench Verified obtiene 78%, superando tanto a la serie Gemini 2.5 como a Gemini 3 Pro: fuerte para programación agéntica y desarrollo iterativo con mucha menor latencia.
¿Qué tan rápido y eficiente es?
Funciona unas 3 veces más rápido que Gemini 2.5 Pro y usa en promedio alrededor de un 30% menos de tokens en tareas típicas, optimizado para flujos de baja latencia y alta frecuencia.
¿Qué entradas multimodales admite?
Admite análisis de video, comprensión de imágenes y preguntas visuales, apto para escenarios multimodales en tiempo real como asistencia en juegos e iteración de diseño.
¿Cómo se factura en Velokey?
Se factura por tokens de entrada y salida con un descuento sobre el precio de lista. El precio actual de Velokey se muestra en el área de precios de esta página y en el panel de tu consola, sin suscripción obligatoria.
Empieza a construir con Gemini 3 Flash Preview
Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.