Velokey

GLM 5.2

智谱Chatin 1.12 · out 3.52 Créditos / 1M tokens≈$1.12 / $3.52Disponible

GLM-5.2 es el modelo insignia de Z.ai (Zhipu) para código a escala de proyecto y de largo horizonte, con 1M de tokens y 128K de salida. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.

Contexto de 1M de tokensProgramación agéntica de primera líneaModos de pensamiento ajustablesFunction calling y MCP

Casos de uso

Análisis y refactorización de código base · Ingeniería de largo horizonte

Entrada

Texto

Salida

Texto

Facturación

Por token

0.7
02
2048
2568192
glm-5.2

Inicia una conversación

Escribe un mensaje abajo para comenzar

Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis

Detalles de precio

Precios transparentes por uso, sin costes ocultos.

Precios detallados

Desglose de precios por uso

EspecificaciónPrecioOficialAhorro
Input/1M tokens1.12 Créditos≈$1.121.4 Créditos-20%
Output/1M tokens3.52 Créditos≈$3.524.4 Créditos-20%
Cache Read/1M tokens0.208 Créditos≈$0.2080.26 Créditos-20%

Reglas de facturacion

  • El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
  • Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
  • Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
  • Los modelos basados en tokens se cobran por tokens de entrada y salida.
  • Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
  • El uso es de pago por consumo con deduccion transparente de creditos.

* El coste final depende del resultado generado.

API de GLM-5.2 asequible

Accede a GLM-5.2 de Z.ai en Velokey: contexto de 1M de tokens, programación agéntica de primera línea, modos de pensamiento ajustables y soporte completo de herramientas, con un endpoint unificado y precios por debajo de tarifa para apps de producción.

Conoce GLM-5.2 y su acceso por API

GLM-5.2 es el modelo fundacional insignia de Z.ai (Zhipu), creado para la programación a escala de proyecto y la ingeniería de largo horizonte. Incorpora una ventana de contexto de 1M de tokens y hasta 128K tokens de salida, añade múltiples modos de pensamiento controlados por un parámetro reasoning_effort y lleva la programación agéntica a primera línea: Terminal-Bench 2.1 sube a 81.0 desde 62.0 y SWE-bench Pro a 62.1 desde 58.4. Aporta una comprensión más fuerte del código base a nivel de proyecto, una ejecución multi-paso más estable, mejor adherencia a los estándares de ingeniería y capacidades móviles y del lado del cliente mejoradas. Velokey ofrece una API de GLM-5.2 asequible y fácil de integrar: un endpoint de chat unificado, un flujo de solicitud claro y precios por debajo de tarifa para sistemas de producción, pipelines de agentes y herramientas de automatización.

Contexto de 1M de tokens y comprensión a nivel de proyecto

Una ventana de contexto de 1M de tokens permite a GLM-5.2 leer de una sola vez un código base a nivel de proyecto completo, conectando módulos distantes para razonar de forma coherente sobre arquitectura, dependencias y cambios entre archivos.

Ver documentación
Contexto de 1M de tokens y comprensión a nivel de proyecto

Programación agéntica de primera línea

GLM-5.2 lleva la programación agéntica a primera línea: Terminal-Bench 2.1 sube a 81.0 desde 62.0 y SWE-bench Pro a 62.1 desde 58.4, ejecutando herramientas de código de forma fiable en tareas multi-paso.

Ver documentación
Programación agéntica de primera línea

Ingeniería de largo horizonte estable

Una ejecución multi-paso más estable mantiene en curso los planes de ingeniería largos —desacoplamiento de módulos, migración de API, refactorizaciones— con mejor adherencia a los estándares de producción e ingeniería.

Ver documentación
Ingeniería de largo horizonte estable

Pensamiento ajustable e integración de herramientas

Múltiples modos de pensamiento con un parámetro reasoning_effort te dejan subir o bajar la profundidad, mientras que el function calling nativo, el streaming, la salida JSON estructurada y la integración con MCP lo hacen listo para agentes.

Ver documentación
Pensamiento ajustable e integración de herramientas

Cómo desplegar la API de GLM-5.2 en Velokey

Empieza con solo unos pocos pasos.

1

Regístrate y obtén una API Key

Inicia sesión en la consola de Velokey para generar una API Key que autentica cada solicitud enviada a GLM-5.2.

2

Configura los parámetros de la solicitud

Establece model en glm-5-2 y envía messages. Usa el parámetro reasoning_effort para seleccionar un modo de pensamiento, y habilita function calling, salida estructurada o MCP según necesites.

3

Integra y empieza a llamar

Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para impulsar agentes de código, automatización de ingeniería y tareas de largo horizonte, con el uso gestionado en una sola consola.

Casos de uso reales de GLM-5.2

Desde la programación a escala de proyecto hasta el trabajo móvil y del lado del cliente, cubriendo muchos escenarios de alta autonomía.

Análisis y refactorización de código base

Con un contexto de 1M de tokens y una comprensión de proyecto más fuerte, es apto para analizar y refactorizar un código base completo, incluidos grandes cambios entre archivos.

Ingeniería de largo horizonte

La ejecución multi-paso estable se adapta al desacoplamiento de módulos, la migración de API y otras tareas de ingeniería de larga duración que deben mantenerse según lo planificado.

Aplicación de estándares de producción

Una mejor adherencia a los estándares de ingeniería se adapta a hacer cumplir convenciones, reglas de revisión y calidad de nivel de producción en todo un proyecto.

Desarrollo móvil y de mini programas

Las capacidades mejoradas del lado del cliente se adaptan al desarrollo y la depuración de Android y Mini Programas de WeChat, además del desarrollo de mini juegos.

Reproducción de artículos de investigación

Un razonamiento fuerte y un contexto largo se adaptan a reproducir artículos de investigación, seguir métodos y reconstruir experimentos a partir del material fuente.

Generación de código a video

Una generación de código fiable se adapta a producir videos programáticos con Remotion y otros flujos de código a video.

Por qué elegir Velokey para GLM-5.2

Descuento sobre la tarifa de lista

Llama a GLM-5.2 a un precio más bajo en Velokey: pago por uso sin suscripción forzada, reduciendo el coste inicial. El precio actual se muestra en tu panel.

Interfaz de API unificada

Una sola API Key accede a GLM-5.2 y a otros modelos: sin hacer malabares con múltiples cuentas y claves, simplificando la integración.

Documentación completa y guía de migración

Referencias de endpoints, detalles de parámetros y ejemplos de migración te ayudan a actualizar sin problemas desde GLM-5.1 y a adoptar el contexto largo, los modos de pensamiento y las herramientas.

Estable y de alta disponibilidad

La conmutación por error automática y las rutas de respaldo estables mantienen la disponibilidad cuando la ruta principal está caída, manteniendo la producción fiable.

Referencia API

Ejemplos completos de llamada API y descripcion de parametros

Endpoint

https://api.velokey.ai/v1/chat/completions

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1/chat/completions \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "glm-5.2",
  "created": 1234567890,
  "data": { ... }
}

Preguntas frecuentes sobre la API de GLM-5.2

¿Qué mejora respecto a GLM-5.1?

GLM-5.2 ofrece una comprensión más fuerte del código base a nivel de proyecto, una ejecución multi-paso más estable y mejor adherencia a los estándares de ingeniería. En los benchmarks, Terminal-Bench 2.1 sube a 81.0 (desde 62.0) y SWE-bench Pro a 62.1 (desde 58.4), junto con capacidades móviles y del lado del cliente mejoradas.

¿Qué tan grande es la ventana de contexto y la salida?

GLM-5.2 incorpora una ventana de contexto de 1M de tokens y puede producir hasta 128K tokens de salida, por lo que puede comprender de una sola vez un código base a nivel de proyecto completo y aún así generar grandes refactorizaciones o respuestas extensas. El almacenamiento en caché de contexto ayuda a mantener eficientes las conversaciones largas.

¿Cómo funcionan los modos de pensamiento y reasoning_effort?

GLM-5.2 admite múltiples modos de pensamiento controlados por un parámetro reasoning_effort (por ejemplo "max"), que te permiten subir la profundidad de razonamiento para problemas difíciles o bajarla para menor latencia en solicitudes más simples.

¿Qué capacidades de herramientas e integración están disponibles?

GLM-5.2 admite function calling e invocación de herramientas, respuestas en streaming, salida JSON estructurada e integración con MCP, además de almacenamiento en caché de contexto para conversaciones largas: todo lo necesario para construir pipelines de agentes reales.

¿Cómo se factura en Velokey?

Llamas a GLM-5.2 a través de un endpoint unificado y una API Key con precios por debajo de tarifa. El área de precios de esta página muestra el precio actual de Velokey en el panel, facturado por tokens de entrada y salida con un descuento sobre la tarifa de lista.

Empieza a construir con GLM 5.2

Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.