Velokey

Gemini 3 Flash Preview

GoogleChatin 0.4 · out 2.4 Créditos / 1M tokens≈$0.4 / $2.4Disponible

Gemini 3 Flash es el modelo de Google DeepMind que une razonamiento de nivel Pro con la latencia, eficiencia y coste de la serie Flash. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.

Razonamiento de nivel ProSWE-bench 78%3x más rápido que 2.5 ProMultimodal imagen y video

Casos de uso

Programación agéntica y desarrollo iterativo · Apps interactivas y de consumo

Entrada

Texto, imagen

Salida

Texto

Facturación

Por token

0.7
02
2048
2568192
gemini-3-flash-preview

Inicia una conversación

Escribe un mensaje abajo para comenzar

Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis

Detalles de precio

Precios transparentes por uso, sin costes ocultos.

Precios detallados

Desglose de precios por uso

EspecificaciónPrecioOficialAhorro
Input/1M tokens0.4 Créditos≈$0.40.5 Créditos-20%
Output/1M tokens2.4 Créditos≈$2.43 Créditos-20%
Cache Read/1M tokens0.04 Créditos≈$0.040.05 Créditos-20%

Reglas de facturacion

  • El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
  • Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
  • Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
  • Los modelos basados en tokens se cobran por tokens de entrada y salida.
  • Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
  • El uso es de pago por consumo con deduccion transparente de creditos.

* El coste final depende del resultado generado.

API de Gemini 3 Flash asequible

Accede a Gemini 3 Flash de Google en Velokey: razonamiento de nivel Pro, programación de primer nivel y comprensión multimodal con latencia y coste de nivel Flash, con un endpoint unificado y precios por debajo de lista para apps de producción.

Conoce Gemini 3 Flash y su acceso por API

Gemini 3 Flash es el modelo de Google DeepMind lanzado el 17 de diciembre de 2025, que combina razonamiento de nivel Pro con la latencia, eficiencia y coste de la serie Flash. Une el razonamiento de frontera con la velocidad Flash: 90,4% en GPQA Diamond, 78% en SWE-bench Verified (superando tanto a la serie 2.5 como a Gemini 3 Pro) y 81,2% en MMMU Pro, comparable a Gemini 3 Pro. Funciona unas 3 veces más rápido que Gemini 2.5 Pro y usa alrededor de un 30% menos de tokens en tareas típicas. Velokey ofrece una API de Gemini 3 Flash asequible y fácil de integrar: un endpoint de chat unificado, un flujo claro y precios por debajo de lista mostrados en el panel de tu consola para sistemas de producción, pipelines de agentes y apps de consumo.

Razonamiento de nivel Pro a coste Flash

Une el razonamiento de frontera con la velocidad Flash: 90,4% en GPQA Diamond y 33,7% en Humanity's Last Exam (sin herramientas), superando a Gemini 2.5 Pro en varios benchmarks, todo con latencia y coste de nivel Flash.

Ver documentación
Razonamiento de nivel Pro a coste Flash

Programación de primer nivel que supera a 3 Pro

Obtiene 78% en SWE-bench Verified, superando tanto a la serie Gemini 2.5 como a Gemini 3 Pro: apto para programación agéntica, uso de herramientas y bucles de desarrollo iterativo.

Ver documentación
Programación de primer nivel que supera a 3 Pro

3x más rápido con 30% menos tokens

Funciona unas 3 veces más rápido que Gemini 2.5 Pro y usa en promedio alrededor de un 30% menos de tokens en tareas típicas, optimizado para flujos de baja latencia y alta frecuencia.

Ver documentación
3x más rápido con 30% menos tokens

Comprensión multimodal en tiempo real

Maneja análisis de video, comprensión de imágenes y preguntas visuales, apto para escenarios multimodales en tiempo real como asistencia en juegos e iteración de diseño.

Ver documentación
Comprensión multimodal en tiempo real

Cómo desplegar la API de Gemini 3 Flash en Velokey

Empieza en solo unos pasos.

1

Regístrate y obtén una API Key

Inicia sesión en la consola de Velokey para generar una API Key que autentica todas las solicitudes enviadas a Gemini 3 Flash.

2

Configura los parámetros de la solicitud

Establece model en gemini-3-flash y envía messages. Añade imágenes o video para tareas multimodales y mantén las solicitudes ligeras para aprovechar la latencia de nivel Flash.

3

Integra y empieza a llamar

Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para impulsar asistentes, agentes y apps interactivas, con el uso gestionado en una sola consola.

Casos de uso reales de Gemini 3 Flash

De la ingeniería a los productos interactivos, cubriendo muchos escenarios de baja latencia.

Programación agéntica y desarrollo iterativo

78% en SWE-bench Verified con latencia de nivel Flash: apto para programación agéntica, iteración rápida y bucles de desarrollo con herramientas.

Apps interactivas que necesitan respuestas rápidas

Baja latencia y bajo coste: apto para apps interactivas que necesitan respuestas rápidas y de alta frecuencia.

Análisis multimodal en tiempo real

Video, imagen y preguntas visuales: apto para escenarios en tiempo real como asistencia en juegos e iteración de diseño.

Tareas de razonamiento complejo

90,4% en GPQA Diamond y 33,7% en Humanity's Last Exam (sin herramientas): apto para problemas científicos y de razonamiento difíciles.

Flujos de alta frecuencia

Unas 3 veces más rápido que 2.5 Pro con ~30% menos de tokens: apto para pipelines de alto rendimiento y sensibles al coste.

Aplicaciones de consumo

Velocidad y coste de nivel Flash: apto para productos de consumo que sirven a muchos usuarios a escala.

Por qué elegir Velokey para Gemini 3 Flash

Descuento sobre el precio de lista

Llama a Gemini 3 Flash a un precio más bajo en Velokey: pago por uso sin suscripción obligatoria, reduciendo el coste inicial.

Interfaz de API unificada

Una sola API Key accede a Gemini 3 Flash y a otros modelos, sin gestionar varias cuentas y claves, simplificando la integración.

Documentación completa y ejemplos

Referencias de endpoints, detalles de parámetros y ejemplos multimodales te ayudan a integrar razonamiento, programación y visión rápidamente.

Estable y de alta disponibilidad

La conmutación por error automática y las rutas de respaldo estables mantienen la disponibilidad cuando la ruta principal falla, manteniendo la producción fiable.

Referencia API

Ejemplos completos de llamada API y descripcion de parametros

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3-flash-preview",
  "created": 1234567890,
  "data": { ... }
}

Preguntas frecuentes de la API de Gemini 3 Flash

¿Qué hace diferente a Gemini 3 Flash?

Combina razonamiento de nivel Pro con la latencia, eficiencia y coste de la serie Flash, uniendo el razonamiento de frontera con la velocidad Flash. Alcanza 90,4% en GPQA Diamond, 78% en SWE-bench Verified y 81,2% en MMMU Pro, funcionando unas 3 veces más rápido que Gemini 2.5 Pro.

¿Cómo se compara su programación con Gemini 3 Pro?

En SWE-bench Verified obtiene 78%, superando tanto a la serie Gemini 2.5 como a Gemini 3 Pro: fuerte para programación agéntica y desarrollo iterativo con mucha menor latencia.

¿Qué tan rápido y eficiente es?

Funciona unas 3 veces más rápido que Gemini 2.5 Pro y usa en promedio alrededor de un 30% menos de tokens en tareas típicas, optimizado para flujos de baja latencia y alta frecuencia.

¿Qué entradas multimodales admite?

Admite análisis de video, comprensión de imágenes y preguntas visuales, apto para escenarios multimodales en tiempo real como asistencia en juegos e iteración de diseño.

¿Cómo se factura en Velokey?

Se factura por tokens de entrada y salida con un descuento sobre el precio de lista. El precio actual de Velokey se muestra en el área de precios de esta página y en el panel de tu consola, sin suscripción obligatoria.

Empieza a construir con Gemini 3 Flash Preview

Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.