Modelos lingüísticos de gran tamaño

Modelos lingüísticos de gran tamaño

Xiaomi MiMo

Xiaomi MiMo

Xiaomi MiMo-V2.5 combina un sistema multimodal con contexto de un millón de tokens y precios de API extremadamente bajos; la variante Pro escala hasta un billón de parámetros totales con 42.000 millones activos. Las afirmaciones más ambiciosas sobre tareas largas siguen siendo del proveedor y específicas de cada variante.

CAPTURA DEL MODELO ACTUAL

Proveedor: Xiaomi MiMo Team
Ancla actual: MiMo-V2.5 y V2.5-Pro
Ciclo de vida: Actual
Pesos: Peso abierto según MIT términos
Revisado: 21 de julio de 2026

Degradado abstracto azul y morado

MiMo-V2.5 es la apuesta integral de Xiaomi por la IA agéntica

Xiaomi abrió MiMo-V2.5 en versión beta pública el 23 de abril de 2026 y actualizó la familia el 29 de junio. El modelo estándar V2.5 es multimodal de forma nativa en texto, imagen, vídeo y audio. MiMo-V2.5-Pro ​​escala a un billón de parámetros totales mientras activa alrededor de 42 mil millones por token, con una ventana de contexto de un millón de tokens.

La distinción entre variantes es importante. Las demostraciones de proveedores para el modelo Pro no deben atribuirse automáticamente al terminal estándar V2.5, y las evaluaciones independientes de V2.5 no necesariamente describen Pro. Los compradores empresariales deben registrar el identificador exacto, el modo de razonamiento, la configuración del contexto y la fecha de lanzamiento en cada punto de referencia.

Xiaomi publicó ponderaciones bajo los términos del MIT, lo que hace que la familia sea inusualmente permisiva para la experimentación comercial y la implementación autogestionada. Esa apertura legal no hace que un punto de control de un billón de parámetros sea operativamente pequeño.

La economía es excepcional; los benchmarks necesitan etiquetas precisas

Artificial Analysis informa que el punto final estándar MiMo-V2.5 tiene una puntuación de índice de inteligencia de 37, alrededor de 63 tokens de salida por segundo y precios de lista cercanos a $0,14 por millón de tokens de entrada y $0,28 por millón de tokens de salida. Se trata de un perfil de costes agresivo, pero no es una puntuación independiente para V2.5-Pro.

Xiaomi informa que Pro completó una larga tarea de codificación que abarcó 8192 líneas de código, 1868 llamadas de herramientas y 11,5 horas. La compañía también informa un uso de tokens un 42% menor que Kimi K2.6 en una comparación y una ventaja del 50% sobre Muse Spark para el modelo estándar. Estos resultados muestran el ámbito operativo previsto; necesitan reproducción bajo el propio andamio del comprador y pruebas de aceptación.

  • Los precios bajos de los tokens hacen que la evaluación del flujo de trabajo sea asequible.

  • Los resultados profesionales y estándar deben permanecer separados en los informes.

  • La larga duración de las tareas no es automáticamente una virtud; la calidad de finalización, la recuperación y el esfuerzo del revisor determinan el valor.

El caso empresarial: pesos con licencia permisiva y costes unitarios muy bajos

MiMo merece una evaluación para la extracción multimodal de gran volumen, los agentes de ingeniería de larga duración y las organizaciones que desean opciones alojadas y autoadministradas. El principal riesgo no es la falta de capacidad; se supone que una demostración del proveedor se transfiere sin cambios a otra infraestructura y entorno de herramientas.

Cómo la evaluaríamos

Ejecute la misma tarea en el estándar V2.5 y Pro con indicaciones, herramientas, límites de tiempo y pruebas de aceptación fijos. Finalización de informes, reclamos no respaldados, fallas de herramientas recuperadas, tokens totales, costo, latencia y tiempo del revisor. Para el autohospedaje, agregue pérdida de cuantificación, rendimiento por acelerador, personal operativo y procedencia de la licencia.

Evidencia utilizada

Estado de soporte de Beam AI

En evaluación. Esta página no confirma una integración de Beam, una región aprobada o una recomendación de producción. Valide la variante MiMo exacta y la superficie de implementación antes de confirmar.

Caso de uso 1

Agente de codificación de larga duración

Proporcione al estándar V2.5 y Pro el mismo cambio de repositorio múltiple con pruebas y fallas deliberadas de las herramientas. Califique los parches aceptados, las regresiones, la recuperación, el uso de tokens, el tiempo del reloj de pared y las correcciones del revisor.

Caso de uso 2

Ingesta multimodal a escala

Procese documentos, capturas de pantalla, audio y video en un registro de caso mecanografiado con enlaces de origen. Mida la precisión de los campos, las omisiones, las inferencias no admitidas, la latencia y el costo por registro aceptado.

Caso de uso 3

Enrutamiento de agentes sensible al costo

Dirija las tareas simples a MiMo y los casos difíciles a un modelo premium. Mida la precisión de la escalada, la tasa de finalización combinada, el costo total del token y si el trabajo barato de primer paso genera una costosa deuda de revisión.

Caso de uso 4

Estudio de implementación con licencia del MIT

Compare el servicio alojado con una versión de peso autoadministrada. Incluya la procedencia de los artefactos, la cuantificación, las necesidades del acelerador, el rendimiento, la observabilidad, los controles de seguridad, la aplicación de parches y el costo operativo total.

Otros LLM

Aquí tienes una lista de LLMs que se pueden utilizar con Beam

Empieza hoy

Desarrolle agentes de IA con el modelo idóneo

Descubra cómo Beam puede orquestar flujos de trabajo de IA gobernados a través de la familia de modelos que mejor se adapte a sus requisitos empresariales.

Empieza hoy

Desarrolle agentes de IA con el modelo idóneo

Descubra cómo Beam puede orquestar flujos de trabajo de IA gobernados a través de la familia de modelos que mejor se adapte a sus requisitos empresariales.

Empieza hoy

Desarrolle agentes de IA con el modelo idóneo

Descubra cómo Beam puede orquestar flujos de trabajo de IA gobernados a través de la familia de modelos que mejor se adapte a sus requisitos empresariales.

PREGUNTAS FRECUENTES

Preguntas frecuentes

Respuestas a sus preguntas sobre selección de modelos, despliegue, gobernanza y soporte de Beam.

¿Cuál es la diferencia entre MiMo-V2.5 y V2.5-Pro?

V2.5 es la versión multimodal ampliamente evaluada; Pro es la variante más grande de un billón de parámetros y 42B activos utilizada en las demostraciones a largo plazo más ambiciosas de Xiaomi. No mezcle sus declaraciones de referencia o costos.

¿Qué tan fuerte es MiMo-V2.5 de forma independiente?

Artificial Analysis informa una puntuación de 37 para el punto final estándar V2.5, alrededor de 63 tokens de salida por segundo y precios de lista muy bajos. Ese resultado no debe volver a etiquetarse como puntuación Pro.

¿Las pesas MiMo se pueden utilizar comercialmente?

Xiaomi afirma que las pesas V2.5 se lanzan según los términos del MIT, lo que permite su uso comercial. Los equipos legales aún deben verificar el repositorio exacto, los avisos, las dependencias y la procedencia de los artefactos.

¿Un contexto de 1M hace que MiMo sea adecuado para cualquier tarea larga?

No. Se debe probar la capacidad de contexto prolongado para determinar la estabilidad de la recuperación, la retención de instrucciones, la disciplina de las herramientas, la latencia y el costo. Muchos flujos de trabajo aún funcionan mejor con recuperación explícita y puntos de control preparados.

¿Beam es compatible con Xiaomi MiMo en producción?

La compatibilidad con Beam está actualmente bajo evaluación. No se adjunta ninguna integración de producción aprobada ni punto de referencia de Beam a este registro CMS.