MiniMax M3 merece un piloto controlado cuando el trabajo necesita contexto largo, entrada de imagen o vídeo y ciclos de herramientas. No sustituye automáticamente a M2.7: las tareas simples pueden preferirlo, y una depuración difícil puede requerir otro modelo.
El ancla es capacidad frente a cuota. La API, revisada el 20 de septiembre de 2026, publica un millón de tokens totales de entrada más salida para M3 frente a 204.800 para M2.7. Los planes y la comunidad muestran que una ventana grande no equivale a más cuota ni a menor coste por tarea.
Puntos clave
M3 combina pesos abiertos, contexto total de 1M, entrada nativa de imagen/vídeo y código agéntico.
La API indica más de 100 frente a unos 60 tokens/s, pero proveedor y harness cambian la observación.
API, Token Plan, proveedores y Tabbit son economías separadas.
MiniMax publica 59,0% en SWE-Bench Pro y 66,0% en Terminal-Bench 2.1, además de ejemplos largos propios.
Los usuarios lo describen como caballo de batalla barato o como una fuente de cuota y depuración difícil.
Consulta el modelo (English), sus prompts (English) y sus evaluaciones (English).
Especificaciones y acceso
| Dato | Fuente | Límite |
|---|---|---|
| Contexto | 1.000.000 tokens totales | Incluye entrada y salida |
| Modalidad | Imagen y vídeo nativos según lanzamiento | Depende del cliente |
| API | HTTP, SDK de Anthropic y OpenAI | Claves separadas del plan |
| API | Tarifa estándar hasta 512K de entrada; mayor después | No se mostró tabla completa de dólares |
| Token Plan | 20/50/120 dólares y bolsas aproximadas | Se comparte entre modalidades |
| Tabbit | La página pública enumera M3 | No hay prueba autenticada ni cuota exacta |
La documentación API compara M2.7: 204.800 tokens y unos 60 tokens/s. La guía de Claude Code pide limpiar variables de Anthropic y confirmar /status y /model. Es un control de ruta, no una garantía de calidad.
El API factura por uso y distingue sus claves de las de Token Plan. MiniMax describe una tarifa para entradas de hasta 512K y otra superior para contextos largos; consulta la página de precios. Token Plan es una cuota mensual compartida. Un proveedor puede añadir sus propios precios, caché, región y política de datos. Un comentario de Reddit sobre un plan OpenCode de 10 dólares no es una factura oficial.
Tabbit enumera M3, Trial gratuito, Standard ampliado al usarlo como navegador predeterminado y Pro opcional. No muestra el coste exacto por modelo. La explicación de navegador agéntico y la comparación describen la capa de cliente.
Cambios desde M2.7
| Dimensión | M2.7 | M3 |
|---|---|---|
| Contexto | 204.800 | 1.000.000 |
| Velocidad aproximada | 60 tokens/s | Más de 100 tokens/s |
| Entrada | Ruta de texto | Imagen y vídeo nativos |
| Razonamiento | Depende de la ruta | Conmutable en API; activo por defecto en Claude Code |
| Enfoque | Agente fuerte | Código, herramientas y colaboración larga |
MiniMax publica 59,0% SWE-Bench Pro, 66,0% Terminal-Bench 2.1, 34,8% SWE-fficiency, 28,8% KernelBench Hard y 74,2% MCP Atlas. También describe una reproducción de artículo de casi 12 horas y una optimización Hopper de unas 24 horas. Son casos del proveedor, no una tasa para tu repositorio.
La prueba de Joseph Perla en X informa 68,1 en DRACO con cinco ejecuciones M3 y un coste modelado de 37 dólares. Un experimento de Reddit dice que M3 conserva más contexto en 20 turnos de herramientas mientras K2.6 responde más rápido en un turno. Son señales estrechas.
Autocomprobación por escenario
| Si haces esto | Empieza con |
|---|---|
| Código con logs y muchas herramientas | M3 API o MiniMax Code |
| Investigación con imagen o vídeo | Una ruta que exponga archivos |
| Ediciones breves y subtareas mecánicas | M2.7 o un modelo rápido |
| Depuración de fallos desconocidos | M3 más un modelo de escalada |
| Cuota mensual estricta | Mide una sesión completa |
| Datos sensibles | Comprueba región y retención del proveedor |
Para el contexto de trabajo agéntico, consulta razonamiento y deep research, automatización del navegador y mejores navegadores AI.
Límite de Tabbit
Durante la investigación se comprobó la página pública de Tabbit. Enumera MiniMax M3, pero no mostró selector autenticado, etiqueta del modelo, salida ni cuota. Este artículo no afirma una ejecución. Antes de publicar, prueba una tarea reversible y captura modelo, salida y límites.
Veredicto
M3 es prometedor para código con contexto largo, entradas multimodales y bucles de agente. La capacidad no unifica API, Token Plan, proveedores y Tabbit, ni elimina la necesidad de escalar la depuración difícil. El artículo permanece en borrador hasta la prueba Tabbit y las capturas comunitarias exigidas.
Fuentes
Preguntas frecuentes
¿Qué es MiniMax M3?
Es el modelo M de MiniMax para código, herramientas agénticas, contexto largo y entrada nativa de imagen y vídeo. La API publica un contexto total de un millón de tokens.
¿Qué cambió desde M2.7?
La tabla oficial indica 1.000.000 frente a 204.800 tokens y más de 100 frente a unos 60 tokens por segundo. M3 también añade multimodalidad nativa y un interruptor de razonamiento.
¿Cómo se obtiene?
MiniMax ofrece MiniMax Code, Token Plan y API de pago por uso. La API admite HTTP y los SDK de Anthropic y OpenAI; los proveedores y Tabbit son rutas distintas.
¿Cuánto cuesta?
La página de lanzamiento muestra planes de 20, 50 y 120 dólares mensuales con bolsas aproximadas. No convierte esas cuotas en precios de API; la tabla completa de API no apareció en las páginas abiertas.
¿Está en Tabbit?
La página pública de Tabbit enumera MiniMax M3, pero no se comprobó un selector autenticado ni una ejecución. La cuota exacta y el precio Pro no aparecen allí.
¿Quién debería usarlo?
Es un buen piloto para código con contexto largo, investigación multimodal y bucles persistentes. Mantén M2.7 para subtareas sencillas y una escalada para depuración difícil.