Velokey

MiniMax M3

MiniMaxChatin 0.24 · out 0.96 Créditos / 1M tokens≈$0.24 / $0.96Disponible

MiniMax M3 es el primer modelo de pesos abiertos con tres fronteras: programación top, contexto de 1M de tokens y multimodalidad nativa. Accede a través del endpoint unificado de Velokey con precios por debajo de lista.

Tres fronteras en unoProgramación y agentes de primer nivelContexto de 1M tokensMultimodalidad nativa

Casos de uso

Programación profunda y trabajo en bases de código · Agentes autónomos y uso de herramientas

Entrada

Texto, imagen

Salida

Texto

Facturación

Por token

0.7
02
2048
2568192
MiniMax-M3

Inicia una conversación

Escribe un mensaje abajo para comenzar

Regístrate y recibe $0.5 en créditos gratis — unas 20 imágenes gratis

Detalles de precio

Precios transparentes por uso, sin costes ocultos.

Precios detallados

Precios escalonados

Desglose de precios por uso

MiniMax M3

<= 512K tokensLongitud de contexto ≤ 512K
EspecificaciónPrecioOfficial/Fal Price(USD)Ahorro
Input/1M tokens0.24 Créditos≈$0.240.3 Créditos-20%
Output/1M tokens0.96 Créditos≈$0.961.2 Créditos-20%
Cache Read/1M tokens0.048 Créditos≈$0.0480.06 Créditos-20%
> 512K tokensLongitud de contexto > 512K
EspecificaciónPrecioOfficial/Fal Price(USD)Ahorro
Input/1M tokens0.48 Créditos≈$0.480.6 Créditos-20%
Output/1M tokens1.92 Créditos≈$1.922.4 Créditos-20%
Cache Read/1M tokens0.096 Créditos≈$0.0960.12 Créditos-20%

Reglas de facturacion

  • El precio de salida varia por modelo, resolucion, calidad, duracion o uso de tokens.
  • Los archivos de referencia subidos pueden cobrarse por separado cuando el modelo los admite.
  • Capacidades adicionales como busqueda web o busqueda de imagenes pueden cobrarse por solicitud.
  • Los modelos basados en tokens se cobran por tokens de entrada y salida.
  • Si la ruta principal no esta disponible, Velokey puede cambiar automaticamente a una ruta estable de respaldo cuando sea posible.
  • El uso es de pago por consumo con deduccion transparente de creditos.

* El coste final depende del resultado generado.

API de MiniMax M3 asequible

Accede a MiniMax M3 en Velokey: el primer modelo de pesos abiertos que combina programación de primer nivel, contexto de 1M de tokens y multimodalidad nativa, con un endpoint unificado y precios por debajo de lista para apps de producción.

Conoce MiniMax M3 y su acceso por API

MiniMax M3 es un modelo de texto de MiniMax y el primer modelo de pesos abiertos que combina tres capacidades de frontera a la vez: programación de primer nivel, contexto de 1M de tokens y multimodalidad nativa. Alcanza un rendimiento de primer nivel en benchmarks de programación y de agentes, descomponiendo tareas de forma autónoma, invocando herramientas y razonando en varios pasos; los espacios semánticos textual y visual están profundamente alineados para una comprensión multimodal nativa; y su arquitectura MiniMax Sparse Attention (MSA) admite hasta un contexto de 1M de tokens (mínimo garantizado de 512K). Velokey ofrece una API de MiniMax M3 asequible y fácil de integrar: un endpoint de chat unificado, un flujo claro y precios por debajo de lista para sistemas de producción, pipelines de agentes y herramientas de automatización.

Tres fronteras en un modelo de pesos abiertos

El primer modelo de pesos abiertos que combina programación de primer nivel, contexto de 1M de tokens y multimodalidad nativa a la vez, integrando fortalezas que antes vivían en modelos separados.

Ver documentación
Tres fronteras en un modelo de pesos abiertos

Programación de primer nivel y agentes autónomos

Rendimiento de primer nivel en benchmarks de programación y de agentes, con descomposición autónoma de tareas, invocación de herramientas y razonamiento de varios pasos; ha completado una reproducción de un artículo de ICLR en 12 horas y una optimización de kernel CUDA con 9,4x de aceleración.

Ver documentación
Programación de primer nivel y agentes autónomos

Contexto de 1M tokens con Sparse Attention

Construido sobre la arquitectura MiniMax Sparse Attention (MSA), admite hasta un contexto de 1M de tokens con un mínimo garantizado de 512K, procesando con eficiencia bases de código y documentos muy largos.

Ver documentación
Contexto de 1M tokens con Sparse Attention

Multimodalidad nativa

La profunda alineación entre los espacios semánticos textual y visual ofrece comprensión multimodal nativa en lugar de un añadido posterior.

Ver documentación
Multimodalidad nativa

Cómo desplegar la API de MiniMax M3 en Velokey

Empieza en solo unos pasos.

1

Regístrate y obtén una API Key

Inicia sesión en la consola de Velokey para generar una API Key que autentica todas las solicitudes enviadas a MiniMax M3.

2

Configura los parámetros de la solicitud

Establece model en minimax-m3 y envía messages. Usa los endpoints v2.1 para programación, llamada a herramientas de agente y contexto muy largo.

3

Integra y empieza a llamar

Envía solicitudes al endpoint unificado /v1/chat/completions de Velokey para impulsar asistentes, agentes y automatización, con el uso gestionado en una sola consola.

Casos de uso reales de MiniMax M3

De la ingeniería a la investigación, cubriendo muchos escenarios de alta autonomía.

Programación profunda y trabajo en bases de código

Programación de primer nivel junto a un contexto de 1M de tokens, apto para desarrollo, refactorización y ajuste en una base de código entera.

Agentes autónomos y uso de herramientas

Descomposición autónoma de tareas, invocación de herramientas y razonamiento de varios pasos, apto para flujos de agente complejos y automatización de largo horizonte.

Reproducción de investigación e ingeniería

Ha completado una reproducción de un artículo de ICLR en 12 horas y una optimización de kernel CUDA con 9,4x de aceleración, apto para investigación e ingeniería de rendimiento.

Comprensión de documentos y bases de código muy largos

Un contexto de 1M de tokens permite recuperación, síntesis y preguntas sobre documentos muy largos y bases de código enteras.

Comprensión y análisis multimodal

Profunda alineación semántica texto-visual, apto para comprensión, análisis y procesamiento de contenido que mezcla texto e imagen.

Pipelines de automatización de largo horizonte

Descomposición autónoma de tareas e invocación de herramientas, apto para automatización que requiere ejecución de varios pasos y orquestación de herramientas.

Por qué elegir Velokey para MiniMax M3

Descuento sobre el precio de lista

Llama a MiniMax M3 a un precio más bajo en Velokey: pago por uso sin suscripción obligatoria, reduciendo el coste inicial.

Interfaz de API unificada

Una sola API Key accede a MiniMax M3 y a otros modelos, sin gestionar varias cuentas y claves, simplificando la integración.

Documentación completa y guía de incorporación

Referencias de endpoints, detalles de parámetros y ejemplos te ayudan a adoptar rápido las capacidades de programación, agentes y contexto largo.

Estable y de alta disponibilidad

La conmutación por error automática y las rutas de respaldo estables mantienen la disponibilidad cuando la ruta principal falla.

Referencia API

Ejemplos completos de llamada API y descripcion de parametros

Endpoint

https://api.velokey.ai/v1/chat/completions

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1/chat/completions \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MiniMax-M3",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "MiniMax-M3",
  "created": 1234567890,
  "data": { ... }
}

Preguntas frecuentes de la API de MiniMax M3

¿Qué hace único a MiniMax M3?

Es el primer modelo de pesos abiertos que combina tres capacidades de frontera a la vez: programación de primer nivel, contexto de 1M de tokens y multimodalidad nativa, integrando fortalezas que antes vivían en modelos separados.

¿Qué tan bueno es el contexto largo?

Construido sobre la arquitectura MiniMax Sparse Attention (MSA), admite hasta un contexto de 1M de tokens con un mínimo garantizado de 512K, procesando con eficiencia bases de código y documentos muy largos.

¿Cómo rinde en los benchmarks?

Obtiene 83,5 en BrowseComp (superando el 79,3 de Opus 4.7), ocupa el puesto n.º 3 general en PostTrainBench (37,1) y ha demostrado una reproducción de un artículo de ICLR en 12 horas y una optimización de kernel CUDA con 9,4x de aceleración.

¿Cómo puedo acceder?

A través de la API (endpoints v2.1), un Token Plan, la interfaz de agente sin código MiniMax Code, con despliegue de código abierto (HuggingFace/GitHub) próximamente.

¿Cómo se factura en Velokey?

El área de precios de esta página muestra el precio actual de Velokey, facturado por tokens de entrada y salida con un descuento sobre el precio de lista y sin suscripción obligatoria.

Empieza a construir con MiniMax M3

Usa una sola API key para acceder a modelos de IA estables y de bajo coste mediante Velokey.