Xiaomi MiMo
Xiaomi
Xiaomi MiMo-V2.5 verbindet ein multimodales System mit einer Million Token Kontext und extrem niedrigen API-Preisen; die Pro-Variante skaliert auf eine Billion Gesamtparameter bei 42 Milliarden aktiven Parametern. Die stärksten Langzeit-Agenten-Claims stammen jedoch vom Anbieter und gelten jeweils nur für die getestete Variante.
AKTUELLE MODELL-MOMENTAUFNAHME
Anbieter: Xiaomi MiMo Team
Aktueller Anker: MiMo-V2.5 und V2.5-Pro
Lebenszyklus: Aktuelle
Gewichte: Offene Gewichtung unter MIT Bedingungen
Überprüft: 21. Juli 2026

MiMo-V2.5 ist Xiaomis Full-Stack-Angriff auf agentische KI
Xiaomi hat MiMo-V2.5 am 23. April 2026 in der öffentlichen Betaversion eröffnet und die Familie am 29. Juni aktualisiert. Das Standardmodell der Version 2.5 ist von Natur aus multimodal für Text, Bild, Video und Audio. MiMo-V2.5-Pro skaliert auf eine Billion Gesamtparameter und aktiviert dabei etwa 42 Milliarden pro Token, mit einem Kontextfenster von einer Million Token.
Die Unterscheidung zwischen Varianten ist wichtig. Anbieterdemonstrationen für das Pro-Modell sollten nicht automatisch dem Standard-V2.5-Endpunkt zugeordnet werden, und unabhängige Bewertungen von V2.5 beschreiben nicht unbedingt Pro. Unternehmenskäufer sollten in jedem Benchmark die genaue Kennung, den Argumentationsmodus, die Kontextkonfiguration und das Veröffentlichungsdatum notieren.
Xiaomi veröffentlichte Gewichte unter MIT-Bedingungen, was die Familie ungewöhnlich freizügig für kommerzielle Experimente und selbstverwaltete Bereitstellung macht. Diese rechtliche Offenheit macht einen Kontrollpunkt mit Billionen Parametern nicht betrieblich klein.
Die Preisleistung ist außergewöhnlich – die Benchmarks brauchen klare Labels
Artificial Analysis meldet den Standard-MiMo-V2.5-Endpunkt mit einem Intelligence-Index-Wert von 37, etwa 63 Ausgabe-Tokens pro Sekunde und angegebenen Preisen in der Nähe von 0,14 $ pro Million Eingabe-Tokens und 0,28 $ pro Million Ausgabe-Tokens. Das ist ein aggressives Kostenprofil, aber es handelt sich nicht um eine unabhängige Bewertung für V2.5-Pro.
Xiaomi berichtet, dass Pro eine lange Codierungsaufgabe erledigt hat, die 8.192 Codezeilen, 1.868 Toolaufrufe und 11,5 Stunden umfasste. Das Unternehmen meldet außerdem in einem Vergleich eine um 42 % geringere Token-Nutzung als Kimi K2.6 und einen 50 %igen Vorteil gegenüber Muse Spark für das Standardmodell. Diese Ergebnisse zeigen den beabsichtigten Betriebsbereich; Sie benötigen eine Reproduktion unter dem eigenen Gerüst des Käufers und Akzeptanztests.
Niedrige Token-Preise machen eine umfassende Workflow-Bewertung erschwinglich.
Pro- und Standardergebnisse müssen in der Berichterstellung getrennt bleiben.
Eine lange Aufgabendauer ist nicht automatisch eine Tugend; Abschlussqualität, Wiederherstellung und Aufwand des Prüfers bestimmen den Wert.
Der Enterprise-Case: permissive Gewichte und extrem niedrige Stückkosten
MiMo verdient eine Bewertung für multimodale Extraktion mit hohem Volumen, lang laufende Engineering-Agenten und Organisationen, die sowohl gehostete als auch selbstverwaltete Optionen wünschen. Das Hauptrisiko besteht nicht in mangelnder Leistungsfähigkeit; Es wird davon ausgegangen, dass eine Anbieterdemonstration unverändert auf eine andere Infrastruktur und Tool-Umgebung übertragen wird.
Wie wir es bewerten würden
Führen Sie dieselbe Aufgabe auf Standard V2.5 und Pro mit festen Eingabeaufforderungen, Tools, Zeitlimits und Abnahmetests aus. Berichtabschluss, nicht unterstützte Ansprüche, behobene Toolfehler, Gesamtzahl der Token, Kosten, Latenz und Prüferzeit. Fügen Sie für Selbsthosting Quantisierungsverlust, Durchsatz pro Beschleuniger, Betriebspersonal und Lizenzherkunft hinzu.
Verwendete Beweise
Beam AI-Unterstützungsstatus
In Evaluierung. Diese Seite bestätigt keine Beam-Integration, genehmigte Region oder Produktionsempfehlung. Validieren Sie die genaue MiMo-Variante und Bereitstellungsoberfläche, bevor Sie sich verpflichten.
Anwendungsfall 1
Lang laufender Codierungsagent
Geben Sie Standard V2.5 und Pro die gleiche Multi-Repository-Änderung mit Tests und absichtlichen Tool-Fehlern. Bewerten Sie akzeptierte Patches, Regressionen, Wiederherstellung, Token-Nutzung, Arbeitszeit und Prüferkorrekturen.
Anwendungsfall 2
Multimodale Aufnahme in großem Maßstab
Verarbeiten Sie Dokumente, Screenshots, Audio und Video in einem typisierten Falldatensatz mit Quelllinks. Messen Sie Feldgenauigkeit, Auslassungen, nicht unterstützte Schlussfolgerungen, Latenz und Kosten pro akzeptiertem Datensatz.
Anwendungsfall 3
Kostensensitives Agent-Routing
Leiten Sie einfache Aufgaben an MiMo und schwierige Fälle an ein Premium-Modell. Messen Sie die Eskalationsgenauigkeit, die gemischte Abschlussrate, die gesamten Token-Kosten und ob billige Arbeit beim ersten Durchgang teure Überprüfungsschulden verursacht.
Anwendungsfall 4
MIT-lizenzierte Bereitstellungsstudie
Vergleichen Sie den gehosteten Dienst mit einer selbstverwalteten Gewichtsfreigabe. Berücksichtigen Sie Artefaktherkunft, Quantisierung, Beschleunigerbedarf, Durchsatz, Beobachtbarkeit, Sicherheitskontrollen, Patching und Gesamtbetriebskosten.

Verwandte LLMs
Kuratierte Alternativen zum Vergleich, bevor Sie sich für eine Modellfamilie entscheiden.
Häufig gestellte Fragen
Häufig gestellte Fragen
Fragen zu Modellauswahl, Deployment, Governance und Support von Beam AI beantwortet.
Was ist der Unterschied zwischen MiMo-V2.5 und V2.5-Pro?
V2.5 ist die umfassend bewertete multimodale Version; Pro ist die größere Variante mit einer Billion Parameter und 42B-Aktivität, die in Xiaomis ehrgeizigsten langfristigen Demonstrationen verwendet wird. Mischen Sie nicht ihre Benchmark- oder Kostenangaben.
Wie stark ist MiMo-V2.5 unabhängig voneinander?
Artificial Analysis meldet eine Punktzahl von 37 für den Standard-V2.5-Endpunkt, etwa 63 Ausgabetokens pro Sekunde und sehr niedrige Listenpreise. Dieses Ergebnis sollte nicht als Pro-Score umbenannt werden.
Sind MiMo-Gewichte kommerziell nutzbar?
Xiaomi gibt an, dass die V2.5-Gewichte unter MIT-Bedingungen veröffentlicht werden, was für die kommerzielle Nutzung zulässig ist. Rechtsteams sollten dennoch das genaue Repository, Hinweise, Abhängigkeiten und Artefaktherkunft überprüfen.
Ist MiMo durch einen 1M-Kontext für jede lange Aufgabe geeignet?
Nein. Die Langkontextkapazität muss auf Abrufstabilität, Befehlserhaltung, Werkzeugdisziplin, Latenz und Kosten getestet werden. Viele Arbeitsabläufe erzielen mit explizitem Abruf und gestaffelten Prüfpunkten immer noch eine bessere Leistung.
Unterstützt Beam Xiaomi MiMo in der Produktion?
Beam-Unterstützung wird derzeit evaluiert. Diesem CMS-Datensatz ist keine genehmigte Produktionsintegration oder Beam-Benchmark beigefügt.





