MiniMax
MiniMax
MiniMax M3 ist ein Preis-Leistungs-Ausreißer: ein Open-Weight-MoE mit 428 Milliarden Parametern, davon nur 23 Milliarden aktiv, einem Kontextfenster von einer Million Token, nativer Multimodalität und ungewöhnlich hohem Tempo. Community-Lizenz und Self-Hosting-Anforderungen müssen dennoch sorgfältig geprüft werden.
AKTUELLE MODELL-MOMENTAUFNAHME
Anbieter: MiniMax
Aktueller Anker: MiniMax M3
Lebenszyklus: Aktuelle
Gewichte: Offenes Gewicht unter der MiniMax-Community-Lizenz
Geprüft: 21. Juli 2026

MiniMax M3 macht sparse Skalierung für Agenten praktisch
MiniMax M3 wurde am 1. Juni 2026 veröffentlicht und ist ein 428 Milliarden Parameter umfassendes Expertenmodell, das etwa 23 Milliarden Parameter pro Token aktiviert. Sein Multi-Scale-Attention-Design soll ein Kontextfenster mit einer Million Token nutzbar halten, ohne für jedes Token dichte Modellkosten zu zahlen. Dieselbe Familie verarbeitet Text, Bilder und Videos und positioniert M3 als Agentenmodell und nicht als reine Chat-Version.
Die Architektur ist wichtig, weil sie auf den Teil der Unternehmens-KI abzielt, der in Benchmarks häufig übersehen wird: nachhaltige Arbeit über Tools, Dateien und lange Zwischenzustände hinweg. Ein großes Kontextfenster ist nur dann sinnvoll, wenn der Abruf stabil bleibt, Werkzeugaufrufe diszipliniert bleiben und das Modell sich nach einem fehlerhaften Zwischenschritt erholen kann. Das spärliche Routing und der hohe gemessene Durchsatz von M3 machen diese Bewertung wirtschaftlich plausibel.
Die Gewichte sind verfügbar, aber „offenes Gewicht“ ist die genaue Beschreibung. Die MiniMax-Community-Lizenz entspricht nicht Apache 2.0 oder MIT und enthält kommerzielle Bedingungen, die Rechts- und Beschaffungsteams vor der Einbettung oder Weiterverbreitung von Produkten überprüfen sollten.
Was die Benchmarks belegen – und was nicht
Artificial Analysis meldet derzeit einen Intelligence Index-Wert von ungefähr 44 105–108 Ausgabe-Tokens pro Sekunde, ein Kontextfenster mit einer Million Token und aufgeführte API-Preise von etwa 0,30 $ pro Million Eingabe-Tokens und 1,20 $ pro Million Ausgabe-Tokens. In früheren Berichterstattungen zur Markteinführung wurde nach einer früheren Bewertungsmethode ein Wert von 55 angegeben; Diese Zahlen sind nicht direkt vergleichbar. Die veraltete Methodik ist wichtiger als die Überschrift.
MiniMax meldet 83,5 bei BrowseComp und 37,1 bei PostTrainBench. Der interessanteste Beweis ist operativ: In einer 24-stündigen CUDA-Optimierungsübung hat M3 147 Einreichungen in 1.959 Tool-Aufrufen und eine gemeldete 9,4-fache Auslastungsverbesserung hervorgebracht. Das zeigt ein langfristiges Verhalten unter dem Gerüst des Anbieters; es beweist nicht das gleiche Ergebnis auf einem anderen Tool-Stack oder Hardware-Ziel.
Das unabhängige Preis- und Durchsatzprofil macht M3 zu einem ernsthaften Konkurrenten für Agenten mit hohem Volumen.
Vom Anbieter durchgeführte Browser- und Codierungstests sollten mit den Tools, Timeouts und Akzeptanztests des Käufers reproduziert werden.
Ein Limit von einer Million Token ist eine Kapazität und kein Beweis für einen perfekten Abruf oder eine Befehlsaufbewahrung über dieses Fenster hinweg.
Der Enterprise-Case: hoher Hebel, aber Aufwand bei Lizenz und Betrieb
M3 ist attraktiv, wenn ein Team umfangreiche Kontextrecherchen, multimodale Überprüfungen oder die Verwendung von Tools im Repository-Maßstab zu einem viel niedrigeren Token-Preis als geschlossene Premium-Modelle benötigt. Es ist weniger überzeugend, wenn rechtliche Einfachheit, ein geringer Bereitstellungsbedarf oder ausgereifte Managed-Service-Kontrollen wichtiger sind als das bloße Preis-Leistungs-Verhältnis.
Wie wir es bewerten würden
Führen Sie einen vollständigen Prozess mit Browser- und API-Tools, widersprüchlichen Beweisen, einem erzwungenen Toolfehler, einem strengen Ausgabeschema und einem Genehmigungskontrollpunkt aus. Messen Sie akzeptierte Ergebnisse, nicht unterstützte Ansprüche, Wiederherstellungsrate, Tail-Latenz, Gesamttokens und Prüferzeit. Fügen Sie für Selbsthosting den Bereitstellungsdurchsatz, den Quantisierungsverlust, die Beobachtbarkeit, das Patching und den Bereitschaftsaufwand hinzu.
Verwendete Beweise
Beam AI-Unterstützungsstatus
In Evaluierung. Diese Seite ist eine Referenz zur Modellauswahl und keine Bestätigung einer Beam-Integration oder Produktionsempfehlung. Validieren Sie den genauen Endpunkt oder die Gewichtsfreigabe, die Lizenz, die Region, die Aufbewahrung und die Arbeitslast, bevor Sie sie festlegen.
Anwendungsfall 1
Long-Horizon Engineering Agent
Geben Sie M3 eine begrenzte Repository-Änderung, die Suche, Implementierung, Tests, Dokumentation und Wiederherstellung nach einem fehlgeschlagenen Tool-Aufruf erfordert. Bewerten Sie akzeptierte Patches, Regressionen, Gutachterkorrekturen, Ausgabetokens und verstrichene Zeit.
Anwendungsfall 2
Multimodaler Forschungsworkflow
Kombinieren Sie Dokumente, Screenshots, Tabellen und Webbeweise in einem mit der Quelle verknüpften Entscheidungsmemo. Fügen Sie Widersprüche und irrelevantes Material ein und bewerten Sie dann Zitatunterstützung, fehlende Belege, nicht unterstützte Schlussfolgerungen und Prüferzeit.
Anwendungsfall 3
Tool-Orchestrierung mit hohem Volumen
Vergleichen Sie M3 mit einem geschlossenen Premium-Modell bei Tausenden von kurzen und mittleren Tool-Aufgaben. Verfolgen Sie Abschlussrate, Wiederholungsversuche, Endlatenz, Gesamt-Token-Kosten und ob niedrigere Stückpreise die tatsächliche Fehlerbehandlung überstehen.
Anwendungsfall 4
Open-Weight-Serving-Studie
Vergleichen Sie einen genehmigten selbstverwalteten Build mit der gehosteten API. Dazu gehören Lizenzüberprüfung, Artefaktherkunft, Quantisierung, Durchsatz, Sicherheitskontrollen, Überwachung, Patching, Rollback und Gesamtbetriebskosten.

Verwandte LLMs
Kuratierte Alternativen zum Vergleich, bevor Sie sich für eine Modellfamilie entscheiden.
Häufig gestellte Fragen
Häufig gestellte Fragen
Fragen zu Modellauswahl, Deployment, Governance und Support von Beam AI beantwortet.
Ist MiniMax M3 Open Source?
M3 ist Open-Source, aber seine MiniMax-Community-Lizenz ist nicht dasselbe wie eine freizügige Lizenz im OSI-Stil wie Apache 2.0 oder MIT. Lesen Sie vor der Bereitstellung die Bedingungen für kommerzielle Nutzung, Weiterverbreitung und Produkteinbettung.
Wie stark ist MiniMax M3 unabhängig?
Artificial Analysis meldet derzeit einen Intelligence Index-Wert von 44, etwa 105–108 Ausgabe-Tokens pro Sekunde und sehr niedrige aufgeführte Token-Preise. Frühere Startergebnisse verwendeten eine andere Methodik und sollten nicht direkt verglichen werden.
Macht das 1M-Token-Fenster den Abruf überflüssig?
Nein. Es erweitert die Kapazität, garantiert jedoch nicht, dass Beweise gefunden, richtig gewichtet oder über einen langen Arbeitsablauf hinweg aufbewahrt werden. Abruf, Chunking, Zitierungen und Kontexthygiene erfordern noch aufgabenspezifische Tests.
Kann ein Unternehmen MiniMax M3 selbst hosten?
Im Prinzip ja, da Gewichtungen verfügbar sind, aber das 428B-Parametersystem erfordert immer noch ernsthafte Inferenztechnik. Kapazität, Quantisierung, Beschleunigerspeicher, Beobachtbarkeit, Patching und Lizenzeinhaltung gehören zum Business Case.
Unterstützt Beam MiniMax M3 in der Produktion?
Beam-Unterstützung wird derzeit evaluiert. Diesem Datensatz ist keine genehmigte Produktionsintegration oder Beam-Benchmark beigefügt. Validieren Sie zuerst die genaue Oberfläche, die Steuerung, die Region und das Betriebsmodell.





