GLM 5.2
GLM-5.2 es el modelo insignia de Z.ai (Zhipu) para código a escala de proyecto y de largo horizonte, con 1M de tokens y 128K de salida. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.
Casos de uso
Análisis y refactorización de código base · Ingeniería de largo horizonte
Entrada
Texto
Salida
Texto
Facturación
Por token
Inicia una conversación
Escribe un mensaje abajo para comenzar
Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis
Detalles de precio
Precios transparentes por uso, sin costes ocultos.
Precios detallados
Desglose de precios por uso
| Especificación | Precio | Oficial | Ahorro |
|---|---|---|---|
| Input/1M tokens | 1.12 Créditos≈$1.12 | 1.4 Créditos | -20% |
| Output/1M tokens | 3.52 Créditos≈$3.52 | 4.4 Créditos | -20% |
| Cache Read/1M tokens | 0.208 Créditos≈$0.208 | 0.26 Créditos | -20% |
Reglas de facturacion
- El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
- Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
- Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
- Los modelos basados en tokens se cobran por tokens de entrada y salida.
- Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
- El uso es de pago por consumo con deduccion transparente de creditos.
* El coste final depende del resultado generado.
Modelos relacionados
Explora otros modelos de la misma familia.
- ZhipuAhorra 20%
GLM 5
GLM-5 is Z.ai's 744B-parameter (40B active) sparse-attention model with Opus-4.5-level coding, strong agentic tool use, and a 200K context.
- ZhipuAhorra 20%
GLM 5.1
GLM-5.1 is Zhipu's flagship AI model, excelling in programming, complex reasoning, and long-chain tasks.
- OpenAIAhorra 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- AlibabaAhorra 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
API de GLM-5.2 asequible
Accede a GLM-5.2 de Z.ai en Velokey: contexto de 1M de tokens, programación agéntica de primera línea, modos de pensamiento ajustables y soporte completo de herramientas, con un endpoint unificado y precios por debajo de tarifa para apps de producción.
Conoce GLM-5.2 y su acceso por API
GLM-5.2 es el modelo fundacional insignia de Z.ai (Zhipu), creado para la programación a escala de proyecto y la ingeniería de largo horizonte. Incorpora una ventana de contexto de 1M de tokens y hasta 128K tokens de salida, añade múltiples modos de pensamiento controlados por un parámetro reasoning_effort y lleva la programación agéntica a primera línea: Terminal-Bench 2.1 sube a 81.0 desde 62.0 y SWE-bench Pro a 62.1 desde 58.4. Aporta una comprensión más fuerte del código base a nivel de proyecto, una ejecución multi-paso más estable, mejor adherencia a los estándares de ingeniería y capacidades móviles y del lado del cliente mejoradas. Velokey ofrece una API de GLM-5.2 asequible y fácil de integrar: un endpoint de chat unificado, un flujo de solicitud claro y precios por debajo de tarifa para sistemas de producción, pipelines de agentes y herramientas de automatización.
Contexto de 1M de tokens y comprensión a nivel de proyecto
Una ventana de contexto de 1M de tokens permite a GLM-5.2 leer de una sola vez un código base a nivel de proyecto completo, conectando módulos distantes para razonar de forma coherente sobre arquitectura, dependencias y cambios entre archivos.
Ver documentación →
Programación agéntica de primera línea
GLM-5.2 lleva la programación agéntica a primera línea: Terminal-Bench 2.1 sube a 81.0 desde 62.0 y SWE-bench Pro a 62.1 desde 58.4, ejecutando herramientas de código de forma fiable en tareas multi-paso.
Ver documentación →
Ingeniería de largo horizonte estable
Una ejecución multi-paso más estable mantiene en curso los planes de ingeniería largos —desacoplamiento de módulos, migración de API, refactorizaciones— con mejor adherencia a los estándares de producción e ingeniería.
Ver documentación →
Pensamiento ajustable e integración de herramientas
Múltiples modos de pensamiento con un parámetro reasoning_effort te dejan subir o bajar la profundidad, mientras que el function calling nativo, el streaming, la salida JSON estructurada y la integración con MCP lo hacen listo para agentes.
Ver documentación →
Cómo desplegar la API de GLM-5.2 en Velokey
Empieza con solo unos pocos pasos.
Regístrate y obtén una API Key
Inicia sesión en la consola de Velokey para generar una API Key que autentica cada solicitud enviada a GLM-5.2.
Configura los parámetros de la solicitud
Establece model en glm-5-2 y envía messages. Usa el parámetro reasoning_effort para seleccionar un modo de pensamiento, y habilita function calling, salida estructurada o MCP según necesites.
Integra y empieza a llamar
Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para impulsar agentes de código, automatización de ingeniería y tareas de largo horizonte, con el uso gestionado en una sola consola.
Casos de uso reales de GLM-5.2
Desde la programación a escala de proyecto hasta el trabajo móvil y del lado del cliente, cubriendo muchos escenarios de alta autonomía.
Análisis y refactorización de código base
Con un contexto de 1M de tokens y una comprensión de proyecto más fuerte, es apto para analizar y refactorizar un código base completo, incluidos grandes cambios entre archivos.
Ingeniería de largo horizonte
La ejecución multi-paso estable se adapta al desacoplamiento de módulos, la migración de API y otras tareas de ingeniería de larga duración que deben mantenerse según lo planificado.
Aplicación de estándares de producción
Una mejor adherencia a los estándares de ingeniería se adapta a hacer cumplir convenciones, reglas de revisión y calidad de nivel de producción en todo un proyecto.
Desarrollo móvil y de mini programas
Las capacidades mejoradas del lado del cliente se adaptan al desarrollo y la depuración de Android y Mini Programas de WeChat, además del desarrollo de mini juegos.
Reproducción de artículos de investigación
Un razonamiento fuerte y un contexto largo se adaptan a reproducir artículos de investigación, seguir métodos y reconstruir experimentos a partir del material fuente.
Generación de código a video
Una generación de código fiable se adapta a producir videos programáticos con Remotion y otros flujos de código a video.
Por qué elegir Velokey para GLM-5.2
Descuento sobre la tarifa de lista
Llama a GLM-5.2 a un precio más bajo en Velokey: pago por uso sin suscripción forzada, reduciendo el coste inicial. El precio actual se muestra en tu panel.
Interfaz de API unificada
Una sola API Key accede a GLM-5.2 y a otros modelos: sin hacer malabares con múltiples cuentas y claves, simplificando la integración.
Documentación completa y guía de migración
Referencias de endpoints, detalles de parámetros y ejemplos de migración te ayudan a actualizar sin problemas desde GLM-5.1 y a adoptar el contexto largo, los modos de pensamiento y las herramientas.
Estable y de alta disponibilidad
La conmutación por error automática y las rutas de respaldo estables mantienen la disponibilidad cuando la ruta principal está caída, manteniendo la producción fiable.
Referencia API
Ejemplos completos de llamada API y descripcion de parametros
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "glm-5.2",
"created": 1234567890,
"data": { ... }
}Preguntas frecuentes sobre la API de GLM-5.2
¿Qué mejora respecto a GLM-5.1?
GLM-5.2 ofrece una comprensión más fuerte del código base a nivel de proyecto, una ejecución multi-paso más estable y mejor adherencia a los estándares de ingeniería. En los benchmarks, Terminal-Bench 2.1 sube a 81.0 (desde 62.0) y SWE-bench Pro a 62.1 (desde 58.4), junto con capacidades móviles y del lado del cliente mejoradas.
¿Qué tan grande es la ventana de contexto y la salida?
GLM-5.2 incorpora una ventana de contexto de 1M de tokens y puede producir hasta 128K tokens de salida, por lo que puede comprender de una sola vez un código base a nivel de proyecto completo y aún así generar grandes refactorizaciones o respuestas extensas. El almacenamiento en caché de contexto ayuda a mantener eficientes las conversaciones largas.
¿Cómo funcionan los modos de pensamiento y reasoning_effort?
GLM-5.2 admite múltiples modos de pensamiento controlados por un parámetro reasoning_effort (por ejemplo "max"), que te permiten subir la profundidad de razonamiento para problemas difíciles o bajarla para menor latencia en solicitudes más simples.
¿Qué capacidades de herramientas e integración están disponibles?
GLM-5.2 admite function calling e invocación de herramientas, respuestas en streaming, salida JSON estructurada e integración con MCP, además de almacenamiento en caché de contexto para conversaciones largas: todo lo necesario para construir pipelines de agentes reales.
¿Cómo se factura en Velokey?
Llamas a GLM-5.2 a través de un endpoint unificado y una API Key con precios por debajo de tarifa. El área de precios de esta página muestra el precio actual de Velokey en el panel, facturado por tokens de entrada y salida con un descuento sobre la tarifa de lista.
Empieza a construir con GLM 5.2
Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.