Qwen3.7 Max
Qwen3.7-Max es el modelo insignia de Alibaba para agentes: coding de largo alcance, orquestación MCP y ejecución autónoma. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.
Casos de uso
Agente de programación de extremo a extremo · Ingeniería sobre toda la base de código
Entrada
Texto
Salida
Texto
Facturación
Por token
Inicia una conversación
Escribe un mensaje abajo para comenzar
Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis
Detalles de precio
Precios transparentes por uso, sin costes ocultos.
Precios detallados
Desglose de precios por uso
| Especificación | Precio | Oficial | Ahorro |
|---|---|---|---|
| Input/1M tokens | 2 Créditos≈$2 | 2.5 Créditos | -20% |
| Output/1M tokens | 6 Créditos≈$6 | 7.5 Créditos | -20% |
| Cache Read/1M tokens | 0.2 Créditos≈$0.2 | 0.25 Créditos | -20% |
| Cache Write/1M tokens | 2.5 Créditos≈$2.5 | 3.13 Créditos | -20% |
Reglas de facturacion
- El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
- Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
- Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
- Los modelos basados en tokens se cobran por tokens de entrada y salida.
- Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
- El uso es de pago por consumo con deduccion transparente de creditos.
* El coste final depende del resultado generado.
Modelos relacionados
Explora otros modelos de la misma familia.
- AlibabaAhorra 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- AlibabaAhorra 20%
Qwen3.6 Flash
Qwen3.6 Flash (35B-A3B) is Alibaba's open-weight MoE coding model with strong agentic coding, thinking-mode preservation, and a native 262K context (up to 1M with YaRN).
- AlibabaAhorra 20%
Qwen3.7 Plus
Qwen3.7-Plus is Alibaba's multimodal agent model with screen perception and GUI grounding, a 1M-token context, preserve_thinking, and low-cost pricing.
- OpenAIAhorra 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
API de Qwen3.7-Max asequible
Accede a Qwen3.7-Max de Alibaba en Velokey: un agente de programación insignia, un contexto de 1M de tokens, autonomía de largo horizonte de horas y orquestación de herramientas MCP, con un endpoint unificado y precios por debajo de lista para apps de agente en producción.
Conoce Qwen3.7-Max y su acceso por API
Qwen3.7-Max es el modelo propietario insignia de Alibaba, lanzado el 20 de mayo de 2026 en el Alibaba Cloud Summit y creado para la era de los agentes: flujos de programación de largo horizonte, orquestación de herramientas MCP y ejecución autónoma de tareas durante horas (no segundos). Su ventana de contexto crece de 262K en Qwen3.6-Max-Preview a 1 millón de tokens (unas 2000 páginas), suficiente para cargar la mayoría de las bases de código empresariales sin andamiaje de recuperación; como agente de programación destaca desde el prototipado frontend hasta la ingeniería multiarchivo compleja. Es un modelo solo de texto, con una contraparte multimodal, Qwen3.7-Plus. Velokey ofrece una API de Qwen3.7-Max asequible y fácil de integrar: un endpoint de chat unificado, un flujo claro y precios por debajo de lista para sistemas de producción, pipelines de agentes y herramientas de automatización.
Programación agéntica insignia (de frontend a multiarchivo)
Destaca desde el prototipado frontend hasta la ingeniería multiarchivo compleja como agente de programación insignia que entrega aplicaciones completas de extremo a extremo. Benchmarks: SWE-Pro 60.6, SWE-Multilingual 78.3, SciCode 53.5, QwenSVG 1608.
Ver documentación →
Contexto de 1M tokens
La ventana de contexto crece de 262K en Qwen3.6-Max-Preview a 1 millón de tokens (unas 2000 páginas), suficiente para cargar la mayoría de las bases de código empresariales sin andamiaje de recuperación y razonar sobre todo el repositorio.
Ver documentación →
Ejecución de largo horizonte de 35 horas
Mantiene un razonamiento coherente en horizontes extremadamente largos, demostrado por una ejecución de optimización de kernel totalmente autónoma de 35 horas con más de 1000 llamadas a herramientas, llevando las tareas de segundos a horas.
Ver documentación →
Orquestación de herramientas MCP
Nativamente fuerte en orquestación de herramientas MCP, coordina muchos módulos de herramientas conectados a lo largo de largas ejecuciones autónomas para mantener flujos complejos como un solo sistema coherente.
Ver documentación →
Cómo desplegar la API de Qwen3.7-Max en Velokey
Empieza en solo unos pasos.
Regístrate y obtén una API Key
Inicia sesión en la consola de Velokey para generar una API Key que autentica todas las solicitudes enviadas a Qwen3.7-Max.
Configura los parámetros de la solicitud
Establece model en qwen-3-7-max y envía messages. Usa la ventana completa de 1M de tokens para contexto muy largo y conecta herramientas MCP para impulsar la ejecución autónoma de largo horizonte.
Integra y empieza a llamar
Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para impulsar agentes de programación y automatización, con el uso gestionado en una sola consola.
Casos de uso reales de Qwen3.7-Max
De la ingeniería a los agentes empresariales, cubriendo muchos escenarios de alta autonomía.
Agente de programación de extremo a extremo
Del prototipado frontend a la ingeniería multiarchivo compleja, entrega aplicaciones completas de extremo a extremo como agente de programación insignia.
Ingeniería sobre toda la base de código
Con un contexto de 1M de tokens, carga una base de código empresarial entera para desarrollo y refactorización sin andamiaje de recuperación.
Tareas autónomas de largo horizonte
Mantiene un razonamiento coherente en horizontes de horas, apto para tareas autónomas con más de 1000 llamadas a herramientas.
Orquestación de herramientas MCP
Coordina muchos módulos de herramientas conectados, manteniendo flujos multiherramienta complejos orquestados como un solo sistema coherente.
Optimización científica y a nivel de kernel
Apto para programación científica tipo SciCode y optimización a nivel de kernel que exigen razonamiento de largo horizonte e iteración repetida.
DevOps autónomo y automatización
Ejecución autónoma de horas con orquestación de herramientas, apto para DevOps de largo horizonte, procesamiento por lotes y pipelines de automatización.
Por qué elegir Velokey para Qwen3.7-Max
Descuento sobre el precio de lista
Llama a Qwen3.7-Max a un precio más bajo en Velokey: pago por uso sin suscripción obligatoria, reduciendo el coste inicial.
Interfaz de API unificada
Una sola API Key accede a Qwen3.7-Max y a otros modelos, sin gestionar varias cuentas y claves, simplificando la integración.
Documentación completa y guía de migración
Referencias de endpoints, detalles de parámetros y ejemplos de migración te ayudan a actualizar sin problemas desde Qwen3.6-Max-Preview y adoptar el contexto de 1M de tokens y las herramientas MCP.
Estable y de alta disponibilidad
La conmutación por error automática y las rutas de respaldo estables mantienen la disponibilidad cuando la ruta principal falla, manteniendo fiables las tareas de agente de largo horizonte.
Referencia API
Ejemplos completos de llamada API y descripcion de parametros
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-max",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "qwen3.7-max",
"created": 1234567890,
"data": { ... }
}Preguntas frecuentes de la API de Qwen3.7-Max
¿Qué es Qwen3.7-Max?
Es el modelo propietario insignia de Alibaba, lanzado el 20 de mayo de 2026 en el Alibaba Cloud Summit y creado para la era de los agentes: flujos de programación de largo horizonte, orquestación de herramientas MCP y ejecución autónoma de tareas durante horas. Es un modelo solo de texto (existe una contraparte multimodal, Qwen3.7-Plus).
¿Cómo funciona el contexto de 1M de tokens?
La ventana de contexto crece de 262K en Qwen3.6-Max-Preview a 1 millón de tokens (unas 2000 páginas), suficiente para cargar la mayoría de las bases de código empresariales sin andamiaje de recuperación y razonar sobre todo el repositorio directamente.
¿Qué tan buena es la ejecución de largo horizonte?
Mantiene un razonamiento coherente en horizontes extremadamente largos, demostrado por una ejecución de optimización de kernel totalmente autónoma de 35 horas con más de 1000 llamadas a herramientas.
¿Cómo rinde en los benchmarks de programación?
Los benchmarks de agente de programación son SWE-Pro 60.6, SWE-Multilingual 78.3, SciCode 53.5 y QwenSVG 1608, abarcando desde el prototipado frontend hasta la ingeniería multiarchivo compleja.
¿Cómo se factura en Velokey?
El área de precios de esta página muestra el precio actual de Velokey, facturado por tokens de entrada y salida con un descuento sobre el precio de lista. Una sola API Key te da acceso unificado.
Empieza a construir con Qwen3.7 Max
Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.