MiniMax M3
MiniMax M3 es el primer modelo de pesos abiertos con tres fronteras: programación top, contexto de 1M de tokens y multimodalidad nativa. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.
Casos de uso
Programación profunda y trabajo en bases de código · Agentes autónomos y uso de herramientas
Entrada
Texto, imagen
Salida
Texto
Facturación
Por token
Inicia una conversación
Escribe un mensaje abajo para comenzar
Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis
Detalles de precio
Precios transparentes por uso, sin costes ocultos.
Precios detallados
Precios escalonadosDesglose de precios por uso
MiniMax M3
| Especificación | Precio | Official/Fal Price(USD) | Ahorro |
|---|---|---|---|
| Input/1M tokens | 0.24 Créditos≈$0.24 | 0.3 Créditos | -20% |
| Output/1M tokens | 0.96 Créditos≈$0.96 | 1.2 Créditos | -20% |
| Cache Read/1M tokens | 0.048 Créditos≈$0.048 | 0.06 Créditos | -20% |
| Especificación | Precio | Official/Fal Price(USD) | Ahorro |
|---|---|---|---|
| Input/1M tokens | 0.48 Créditos≈$0.48 | 0.6 Créditos | -20% |
| Output/1M tokens | 1.92 Créditos≈$1.92 | 2.4 Créditos | -20% |
| Cache Read/1M tokens | 0.096 Créditos≈$0.096 | 0.12 Créditos | -20% |
Reglas de facturacion
- El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
- Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
- Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
- Los modelos basados en tokens se cobran por tokens de entrada y salida.
- Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
- El uso es de pago por consumo con deduccion transparente de creditos.
* El coste final depende del resultado generado.
Modelos relacionados
Explora otros modelos de la misma familia.
- MiniMaxAhorra 20%
MiniMax M2.7
MiniMax M2.7 is a top open-source model for real-world software engineering and agent building, with strong tool skill-adherence and office-document editing.
- OpenAIAhorra 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- AlibabaAhorra 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- AnthropicAhorra 20%
Claude Fable 5
Anthropic's Mythos-class frontier model, state-of-the-art across coding, agentic work, vision, and scientific research.
API de MiniMax M3 asequible
Accede a MiniMax M3 en Velokey: el primer modelo de pesos abiertos que combina programación de primer nivel, contexto de 1M de tokens y multimodalidad nativa, con un endpoint unificado y precios por debajo de lista para apps de producción.
Conoce MiniMax M3 y su acceso por API
MiniMax M3 es un modelo de texto de MiniMax y el primer modelo de pesos abiertos que combina tres capacidades de frontera a la vez: programación de primer nivel, contexto de 1M de tokens y multimodalidad nativa. Alcanza un rendimiento de primer nivel en benchmarks de programación y de agentes, descomponiendo tareas de forma autónoma, invocando herramientas y razonando en varios pasos; los espacios semánticos textual y visual están profundamente alineados para una comprensión multimodal nativa; y su arquitectura MiniMax Sparse Attention (MSA) admite hasta un contexto de 1M de tokens (mínimo garantizado de 512K). Velokey ofrece una API de MiniMax M3 asequible y fácil de integrar: un endpoint de chat unificado, un flujo claro y precios por debajo de lista para sistemas de producción, pipelines de agentes y herramientas de automatización.
Tres fronteras en un modelo de pesos abiertos
El primer modelo de pesos abiertos que combina programación de primer nivel, contexto de 1M de tokens y multimodalidad nativa a la vez, integrando fortalezas que antes vivían en modelos separados.
Ver documentación →
Programación de primer nivel y agentes autónomos
Rendimiento de primer nivel en benchmarks de programación y de agentes, con descomposición autónoma de tareas, invocación de herramientas y razonamiento de varios pasos; ha completado una reproducción de un artículo de ICLR en 12 horas y una optimización de kernel CUDA con 9,4x de aceleración.
Ver documentación →
Contexto de 1M tokens con Sparse Attention
Construido sobre la arquitectura MiniMax Sparse Attention (MSA), admite hasta un contexto de 1M de tokens con un mínimo garantizado de 512K, procesando con eficiencia bases de código y documentos muy largos.
Ver documentación →
Multimodalidad nativa
La profunda alineación entre los espacios semánticos textual y visual ofrece comprensión multimodal nativa en lugar de un añadido posterior.
Ver documentación →
Cómo desplegar la API de MiniMax M3 en Velokey
Empieza en solo unos pasos.
Regístrate y obtén una API Key
Inicia sesión en la consola de Velokey para generar una API Key que autentica todas las solicitudes enviadas a MiniMax M3.
Configura los parámetros de la solicitud
Establece model en minimax-m3 y envía messages. Usa los endpoints v2.1 para programación, llamada a herramientas de agente y contexto muy largo.
Integra y empieza a llamar
Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para impulsar asistentes, agentes y automatización, con el uso gestionado en una sola consola.
Casos de uso reales de MiniMax M3
De la ingeniería a la investigación, cubriendo muchos escenarios de alta autonomía.
Programación profunda y trabajo en bases de código
Programación de primer nivel junto a un contexto de 1M de tokens, apto para desarrollo, refactorización y ajuste en una base de código entera.
Agentes autónomos y uso de herramientas
Descomposición autónoma de tareas, invocación de herramientas y razonamiento de varios pasos, apto para flujos de agente complejos y automatización de largo horizonte.
Reproducción de investigación e ingeniería
Ha completado una reproducción de un artículo de ICLR en 12 horas y una optimización de kernel CUDA con 9,4x de aceleración, apto para investigación e ingeniería de rendimiento.
Comprensión de documentos y bases de código muy largos
Un contexto de 1M de tokens permite recuperación, síntesis y preguntas sobre documentos muy largos y bases de código enteras.
Comprensión y análisis multimodal
Profunda alineación semántica texto-visual, apto para comprensión, análisis y procesamiento de contenido que mezcla texto e imagen.
Pipelines de automatización de largo horizonte
Descomposición autónoma de tareas e invocación de herramientas, apto para automatización que requiere ejecución de varios pasos y orquestación de herramientas.
Por qué elegir Velokey para MiniMax M3
Descuento sobre el precio de lista
Llama a MiniMax M3 a un precio más bajo en Velokey: pago por uso sin suscripción obligatoria, reduciendo el coste inicial.
Interfaz de API unificada
Una sola API Key accede a MiniMax M3 y a otros modelos, sin gestionar varias cuentas y claves, simplificando la integración.
Documentación completa y guía de incorporación
Referencias de endpoints, detalles de parámetros y ejemplos te ayudan a adoptar rápido las capacidades de programación, agentes y contexto largo.
Estable y de alta disponibilidad
La conmutación por error automática y las rutas de respaldo estables mantienen la disponibilidad cuando la ruta principal falla.
Referencia API
Ejemplos completos de llamada API y descripcion de parametros
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "MiniMax-M3",
"created": 1234567890,
"data": { ... }
}Preguntas frecuentes de la API de MiniMax M3
¿Qué hace único a MiniMax M3?
Es el primer modelo de pesos abiertos que combina tres capacidades de frontera a la vez: programación de primer nivel, contexto de 1M de tokens y multimodalidad nativa, integrando fortalezas que antes vivían en modelos separados.
¿Qué tan bueno es el contexto largo?
Construido sobre la arquitectura MiniMax Sparse Attention (MSA), admite hasta un contexto de 1M de tokens con un mínimo garantizado de 512K, procesando con eficiencia bases de código y documentos muy largos.
¿Cómo rinde en los benchmarks?
Obtiene 83,5 en BrowseComp (superando el 79,3 de Opus 4.7), ocupa el puesto n.º 3 general en PostTrainBench (37,1) y ha demostrado una reproducción de un artículo de ICLR en 12 horas y una optimización de kernel CUDA con 9,4x de aceleración.
¿Cómo puedo acceder?
A través de la API (endpoints v2.1), un Token Plan, la interfaz de agente sin código MiniMax Code, con despliegue de código abierto (HuggingFace/GitHub) próximamente.
¿Cómo se factura en Velokey?
El área de precios de esta página muestra el precio actual de Velokey, facturado por tokens de entrada y salida con un descuento sobre el precio de lista y sin suscripción obligatoria.
Empieza a construir con MiniMax M3
Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.