GLM 5.1
La API de glm-5.1 en Velokey ofrece capacidades estables de conversacion y razonamiento. Envia model, messages, temperature y opciones de streaming para crear agentes, asistentes y flujos de soporte con un endpoint unificado.
Casos de uso
Prototipos con glm-5.1 · Flujos de produccion con glm-5.1
Entrada
Texto, imagen
Salida
Texto
Facturación
Por token
Inicia una conversación
Escribe un mensaje abajo para comenzar
Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis
Detalles de precio
Precios transparentes por uso, sin costes ocultos.
Precios detallados
Desglose de precios por uso
| Especificación | Precio | Oficial | Ahorro |
|---|---|---|---|
| Input/1M tokens | 1.12 Créditos≈$1.12 | 1.4 Créditos | -20% |
| Output/1M tokens | 3.52 Créditos≈$3.52 | 4.4 Créditos | -20% |
| Cache Read/1M tokens | 0.208 Créditos≈$0.208 | 0.26 Créditos | -20% |
Reglas de facturacion
- El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
- Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
- Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
- Los modelos basados en tokens se cobran por tokens de entrada y salida.
- Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
- El uso es de pago por consumo con deduccion transparente de creditos.
* El coste final depende del resultado generado.
Modelos relacionados
Explora otros modelos de la misma familia.
- ZhipuAhorra 20%
GLM 5.2
GLM-5.2 is Z.ai's flagship model with a 1M-token context, strong project-level coding, stable multi-step execution, and adjustable thinking for long-horizon engineering.
- ZhipuAhorra 20%
GLM 5
GLM-5 is Z.ai's 744B-parameter (40B active) sparse-attention model with Opus-4.5-level coding, strong agentic tool use, and a 200K context.
- OpenAIAhorra 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- AlibabaAhorra 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
API de GLM-5.1 asequible
Accede a GLM-5.1 de Z.ai / Zhipu en Velokey: hasta 8 horas de ejecución autónoma sostenida, codificación agéntica al nivel de Opus 4.6, un bucle autónomo de experimentar-analizar-optimizar y un contexto de 200K tokens con integración completa de herramientas, todo a través de un endpoint unificado y con precios por debajo de tarifa.
Conoce GLM-5.1 y su acceso por API
GLM-5.1 es el modelo insignia de Z.ai / Zhipu (id de solicitud glm-5-1), diseñado para tareas autónomas de largo horizonte, optimización de ingeniería compleja y flujos de desarrollo reales. Su capacidad general está alineada con Claude Opus 4.6 y obtiene 58,4 en SWE-Bench Pro, superando a GPT-5.4, Claude Opus 4.6 y Gemini 3.1 Pro. Incluye una ventana de contexto de 200K tokens y hasta 128K de salida máxima, además de Thinking Mode, streaming, llamada a funciones, caché de contexto, salida estructurada (JSON) e integración de herramientas MCP. Velokey ofrece una API de GLM-5.1 asequible y fácil de integrar: un endpoint de chat unificado, una sola clave de API, un flujo de solicitud claro y precios por debajo de tarifa para sistemas en producción, pipelines de agentes y herramientas de automatización.
Hasta 8 horas de ejecución autónoma sostenida
GLM-5.1 puede mantenerse en una sola tarea durante hasta 8 horas de ejecución autónoma sostenida, conservando el contexto y el impulso en trabajos de largo horizonte, ideal para proyectos grandes de varios pasos que de otro modo requerirían supervisión constante.
Ver documentación →
Codificación agéntica al nivel de Opus 4.6
Capacidad general alineada con Claude Opus 4.6, con 58,4 en SWE-Bench Pro y superando a GPT-5.4, Claude Opus 4.6 y Gemini 3.1 Pro: destaca en codificación agéntica y flujos de desarrollo reales.
Ver documentación →
Bucle autónomo de experimentar-analizar-optimizar
GLM-5.1 ejecuta un bucle autónomo de 'experimentar - analizar - optimizar' para la optimización de ingeniería compleja, logrando una aceleración media geométrica de 3,6x en tareas de optimización de KernelBench Level 3.
Ver documentación →
Contexto de 200K con integración completa de herramientas
Una ventana de contexto de 200K tokens y hasta 128K de salida máxima, junto con Thinking Mode, llamada a funciones, integración de herramientas MCP, caché de contexto y salida estructurada (JSON) para crear agentes capaces impulsados por herramientas.
Ver documentación →
Cómo llamar a la API de GLM-5.1 en Velokey
Empieza con solo unos pasos.
Regístrate y obtén una clave de API
Inicia sesión en la consola de Velokey para generar una sola clave de API que autentica cada solicitud enviada a GLM-5.1 a través del endpoint unificado.
Configura los parámetros de la solicitud
Establece model en glm-5-1 y envía messages. Activa Thinking Mode para un razonamiento más profundo y habilita streaming, llamada a funciones o salida estructurada según tu flujo de trabajo.
Integra y empieza a llamar
Envía solicitudes al endpoint unificado de Velokey para impulsar agentes de larga duración, tareas de codificación y automatización, con el uso y la facturación gestionados en una sola consola.
Casos de uso reales de GLM-5.1
Desde agentes de larga duración hasta productividad de oficina, cubriendo muchos escenarios de alta autonomía.
Codificación agéntica y tareas de desarrollo de larga duración
Con hasta 8 horas de ejecución autónoma sostenida y codificación al nivel de Opus 4.6, es apto para la codificación agéntica y tareas de desarrollo de larga duración.
Seguimiento de instrucciones complejas
Conversación general con seguimiento de instrucciones complejas y con múltiples restricciones, manteniendo la coherencia en prompts largos y detallados.
Escritura creativa
Apto para la escritura creativa que necesita una voz, una estructura y una coherencia de formato largo consistentes.
Desarrollo front-end y generación de sitios web
Apto para el desarrollo front-end y la generación completa de sitios web, convirtiendo briefs en diseños y componentes funcionales.
Productividad de oficina
Genera y edita resultados de PowerPoint, Word, PDF y Excel para un trabajo de productividad de oficina repetible.
Optimización de ingeniería
El bucle autónomo de experimentar-analizar-optimizar logra una aceleración de 3,6x en KernelBench Level 3: apto para la optimización de ingeniería compleja.
Por qué elegir Velokey para GLM-5.1
Precios por debajo de tarifa
Llama a GLM-5.1 a un precio más bajo en Velokey: pago por uso sin suscripción obligatoria, reduciendo el coste inicial.
Endpoint unificado, una sola clave de API
Una sola clave de API accede a GLM-5.1 y otros modelos a través de un único endpoint unificado, sin gestionar múltiples cuentas y claves.
Integración completa de herramientas
Thinking Mode, streaming, llamada a funciones, caché de contexto, salida estructurada (JSON) e integración de herramientas MCP listos para usar.
Documentación y guía de integración completas
Referencias de endpoints, detalles de parámetros y ejemplos de integración te ayudan a adoptar sin problemas el contexto de 200K, la autonomía de largo horizonte y las herramientas de GLM-5.1.
Referencia API
Ejemplos completos de llamada API y descripcion de parametros
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.1",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "glm-5.1",
"created": 1234567890,
"data": { ... }
}Preguntas frecuentes sobre la API de glm-5.1
Que es la API de glm-5.1?
glm-5.1 esta disponible en Velokey como modelo de chat. Define model como glm-5-1 y usa el endpoint correspondiente.
Que parametros usa glm-5.1?
El playground muestra los campos principales de glm-5.1, incluido el id del modelo y los parametros de generacion mas importantes.
Que endpoint debo usar para glm-5.1?
Usa tu API key de Velokey, define model como glm-5-1 y llama a /v1/chat/completions.
Como se cobra glm-5.1?
Cuando Velokey puede obtener datos de precio del modelo, esta pagina muestra el precio actual. Los creditos se gestionan desde una sola cuenta de Velokey.
Quien deberia usar la API de glm-5.1?
Es adecuada para equipos que quieren probar, comparar y lanzar capacidades de IA mediante una API unificada.
Empieza a construir con GLM 5.1
Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.