MiniMax
MiniMax
MiniMax M3 destaca por su relación precio-rendimiento: un MoE de pesos abiertos con 428.000 millones de parámetros, de los que solo 23.000 millones están activos, contexto de un millón de tokens, multimodalidad nativa y gran velocidad. Aun así, su licencia comunitaria y las exigencias de autohospedaje requieren una revisión cuidadosa.
CAPTURA DEL MODELO ACTUAL
Proveedor: MiniMax
Ancla actual: MiniMax M3
Ciclo de vida: actual
Pesos: Peso abierto bajo la licencia comunitaria MiniMax
Revisado: 21 Julio de 2026

MiniMax M3 convierte la escala dispersa en un sistema práctico para agentes
Lanzado el 1 de junio de 2026, MiniMax M3 es un modelo de mezcla de expertos de 428 mil millones de parámetros que activa alrededor de 23 mil millones de parámetros por token. Su diseño de atención multiescala está destinado a mantener utilizable una ventana de contexto de un millón de tokens sin pagar un costo de modelo denso por cada token. La misma familia maneja texto, imágenes y video, posicionando a M3 como un modelo de agente en lugar de una versión solo de chat.
La arquitectura es importante porque apunta a la parte de la IA empresarial que los puntos de referencia a menudo pasan por alto: el trabajo sostenido entre herramientas, archivos y estados intermedios prolongados. Una ventana de contexto grande es útil sólo si la recuperación permanece estable, las llamadas a herramientas siguen siendo disciplinadas y el modelo puede recuperarse de un mal paso intermedio. El enrutamiento escaso de M3 y el alto rendimiento medido hacen que esa evaluación sea económicamente plausible.
Los pesos están disponibles, pero "peso abierto" es la descripción precisa. La licencia comunitaria MiniMax no es equivalente a Apache 2.0 o MIT e incluye condiciones comerciales que los equipos legales y de adquisiciones deben revisar antes de incorporar o redistribuir el producto.
Qué demuestran los benchmarks —y qué no
Artificial Analysis actualmente informa una puntuación del índice de inteligencia de 44, aproximadamente 105–108 tokens de salida por segundo, una ventana de contexto de un millón de tokens y precios de API listados de alrededor de $0,30 por millón de tokens de entrada y $1,20 por millón de tokens de salida. La cobertura del lanzamiento anterior citó una puntuación de 55 según una metodología de evaluación anterior; esas cifras no son directamente comparables. La metodología anticuada importa más que el titular.
MiniMax reporta 83,5 en BrowseComp y 37,1 en PostTrainBench. Su evidencia más interesante es operativa: en un ejercicio de optimización CUDA de 24 horas, M3 produjo 147 envíos en 1.959 llamadas de herramientas y reportó una mejora de utilización de 9,4 veces. Esto demuestra un comportamiento a largo plazo bajo el andamio del proveedor; no demuestra el mismo resultado en otra pila de herramientas o objetivo de hardware.
El perfil independiente de precio y rendimiento convierte a M3 en un serio desafío para los agentes de gran volumen.
Las pruebas de codificación y navegador ejecutadas por el proveedor deben reproducirse con las herramientas, los tiempos de espera y las pruebas de aceptación del comprador.
Un límite de un millón de tokens es capacidad, no evidencia de recuperación perfecta o retención de instrucciones en esa ventana.
El caso empresarial: gran potencial con trabajo de licencia y operación
M3 es atractivo cuando un equipo necesita investigación de contexto a largo plazo, revisión multimodal o uso de herramientas a escala de repositorio a un precio simbólico mucho más bajo que los modelos cerrados premium. Es menos convincente cuando la simplicidad legal, una huella de servicio pequeña o controles maduros de servicios administrados importan más que la relación precio-rendimiento en bruto.
Cómo lo evaluaríamos
Ejecutar un proceso completo con navegador y herramientas API, evidencia contradictoria, una falla forzada de la herramienta, un esquema de salida estricto y un punto de control de aprobación. Mida los resultados aceptados, las reclamaciones no respaldadas, la tasa de recuperación, la latencia final, los tokens totales y el tiempo del revisor. Para el autohospedaje, agregue rendimiento de servicio, pérdida de cuantificación, observabilidad, parches y esfuerzo de guardia.
Evidencia utilizada
Estado de soporte de Beam AI
En evaluación. Esta página es una referencia de selección de modelo, no una confirmación de una integración de Beam o una recomendación de producción. Valide el punto final exacto o la liberación de peso, la licencia, la región, la retención y la carga de trabajo antes de confirmar.
Caso de uso 1
Agente de ingeniería de largo horizonte
Proporcione a M3 un cambio de repositorio limitado que requiera búsqueda, implementación, pruebas, documentación y recuperación de una llamada fallida a la herramienta. Califique los parches aceptados, las regresiones, las correcciones del revisor, los tokens de salida y el tiempo transcurrido.
Caso de uso 2
Flujo de trabajo de investigación multimodal
Combine documentos, capturas de pantalla, tablas y evidencia web en un memorando de decisión vinculado a la fuente. Inserte contradicciones y material irrelevante, luego califique el apoyo a las citas, la evidencia omitida, las conclusiones no respaldadas y el tiempo del revisor.
Caso de uso 3
Orquestación de herramientas de gran volumen
Compare M3 con un modelo cerrado premium en miles de tareas de herramientas cortas y medianas. Realice un seguimiento de la tasa de finalización, los reintentos, la latencia final, el costo total del token y si los precios unitarios más bajos sobreviven al manejo real de fallas.
Caso de uso 4
Estudio de publicación de peso abierto
Compare una compilación autoadministrada aprobada con la API alojada. Incluya revisión de licencia, procedencia de artefactos, cuantificación, rendimiento, controles de seguridad, monitoreo, parches, reversión y costo operativo total.

Otros LLM
Aquí tienes una lista de LLMs que se pueden utilizar con Beam
PREGUNTAS FRECUENTES
Preguntas frecuentes
Respuestas a sus preguntas sobre selección de modelos, despliegue, gobernanza y soporte de Beam.
¿Es MiniMax M3 de código abierto?
M3 es de peso abierto, pero su licencia comunitaria MiniMax no es lo mismo que una licencia permisiva de estilo OSI como Apache 2.0 o MIT. Revise los términos de uso comercial, redistribución e incorporación de productos antes de la implementación.
¿Qué potencia tiene MiniMax M3 de forma independiente?
Artificial Analysis actualmente informa una puntuación de índice de inteligencia de 44, alrededor de 105 a 108 tokens de salida por segundo y un precio de token muy bajo. Las puntuaciones de lanzamientos anteriores utilizaron una metodología diferente y no deben compararse directamente.
¿La ventana de 1 millón de tokens elimina la necesidad de recuperación?
No. Amplía la capacidad, pero no garantiza que las pruebas se encuentren, se ponderen correctamente o se conserven durante un flujo de trabajo prolongado. La recuperación, la fragmentación, las citas y la higiene del contexto aún necesitan pruebas específicas para cada tarea.
¿Puede una empresa autohospedar MiniMax M3?
Sí, en principio, porque hay pesos disponibles, pero el sistema de parámetros 428B aún requiere ingeniería de inferencia seria. La capacidad, la cuantificación, la memoria del acelerador, la observabilidad, la aplicación de parches y el cumplimiento de las licencias pertenecen al caso empresarial.
¿Beam es compatible con MiniMax M3 en producción?
El soporte de Beam está actualmente bajo evaluación. No se adjunta a este registro ninguna integración de producción aprobada ni punto de referencia de Beam; valide primero la superficie exacta, los controles, la región y el modelo operativo.





