MODELLVERZEICHNIS

MODELL-VERZEICHNIS

Google Gemma

Google Gemma

Gemma 4 kombiniert eine praxisnahe Modellpalette, Multimodalität, breite Sprachabdeckung und Apache-2.0-Gewichte. Googles Benchmark-Tabelle ist stark; die unabhängige Bewertung des 31B-Modells fällt nüchterner aus. Deshalb zählt der Test der exakten Variante.

AKTUELLE MODELL-MOMENTAUFNAHME

Anbieter: Google
Aktueller Anker: Gemma 4, mit 31B als Referenzvariante
Lebenszyklus: Aktuell
Gewichte: Offene Gewichtung unter Apache 2.0
Überprüft: 21. Juli 2026

Abstrakter blau-violetter Farbverlauf

Gemma 4 ist ein Modell-Ökosystem, kein einzelner Checkpoint

Google hat Gemma 4 am 2. April 2026 als Familie veröffentlicht, die von kantenorientierten E2B- und E4B-Varianten bis hin zu 12B reicht. Modelle 26B-A4B und 31B. Die größeren Varianten unterstützen ein Kontextfenster mit bis zu 256.000 Token, während kleinere Konfigurationen auf 128.000 Token abzielen. Text, Bilder und Videos werden in der gesamten Familie unterstützt, wobei Audio in ausgewählten kleineren oder einheitlichen Varianten verfügbar ist.

Die Familie ist in mehr als 140 Sprachen vortrainiert, wobei über 35 als sofort einsatzbereit angekündigt werden. Durch die Gewichtung von Apache 2.0 und das Google-Entwickler-Ökosystem ist Gemma ungewöhnlich zugänglich für Teams, die eine Modellauswahl für Geräte, private Infrastruktur und verwaltete Endpunkte benötigen.

Diese Breite ist auch eine Quelle von Unklarheiten. „Gemma 4“ ist keine einzelne Performance-Nummer. Ein Käufer muss die genaue Parameteranzahl, Konfiguration aktiver Parameter, Modalität, Kontextlimit, Quantisierung, Bereitstellungslaufzeit und Eingabeaufforderungsformat angeben.

Googles Benchmark-Tabelle überzeugt – unabhängige Ergebnisse sind nüchterner

Für Gemma 4 31B meldet Google 85,2 auf MMLU-Pro, 89,2 auf AIME 2026, 80,0 auf LiveCodeBench v6, 84,3 auf GPQA Diamond, 76,9 auf Tau2 und 76,9 auf MMMU-Pro. Die Modellkarte meldet außerdem 66,4 bei MRCR bei 128K. Hierbei handelt es sich um Anbieterergebnisse, die mit ihren Aufgabenaufforderungen, Stichprobeneinstellungen und Vergleichsmodellversionen gelesen werden sollten.

Artificial Analysis meldet einen Intelligenzindexwert von 29 für Gemma 4 31B, etwa 35 Ausgabetokens pro Sekunde und ein 256K-Fenster für den ausgewerteten Endpunkt. Dadurch werden die Aufgabenbewertungen von Google nicht ungültig; Es zeigt, dass die Leistung einer breiten unabhängigen Argumentation mittelmäßiger ist, als die Starttabelle allein vermuten lässt.

  • Gemmas Stärke liegt in der Breite der Bereitstellung und der Modellauswahl, nicht in dem Anspruch, jeden Grenzbenchmark zu gewinnen.

  • Anbieter und unabhängige Suiten beantworten unterschiedliche Fragen und müssen datiert und konfigurationsgebunden sein.

  • Kleine Varianten können hinsichtlich Datenschutz, Latenz und Kosten gewinnen, selbst wenn ihr Gesamtintelligenzwert niedriger ist.

Der Enterprise-Case: flexibel, offen und betrieblich gut beherrschbar

Gemma eignet sich gut für Teams, die eine vertretbare Größentabelle, multimodale Dokumentenarbeit, private Bereitstellung oder Integration mit den Tools von Google benötigen. Es ist weniger geeignet, wenn es sich bei der Anforderung einfach um die höchste verfügbare allgemeine Argumentationsbewertung unabhängig von Kosten oder Bereitstellungskontrolle handelt.

Wie wir es bewerten würden

Wählen Sie zwei Varianten aus, die der tatsächlichen Latenz und dem Infrastrukturrahmen entsprechen. Führen Sie denselben mehrsprachigen, multimodalen Workflow mit Zitaten, einem strengen Schema und kontroversen Beweisen aus. Vergleichen Sie Abschlussqualität, nicht unterstützte Behauptungen, Kontextabruf, Durchsatz, Speicher, Energie und Prüferzeit – nicht nur Benchmark-Durchschnitte.

Verwendete Beweise

Beam AI-Unterstützungsstatus

In Bewertung. Dieser Datensatz bestätigt nicht die Unterstützung für jede Gemma-Variante, Laufzeit, Modalität oder Region. Fixieren Sie das tatsächliche Artefakt und den Bereitstellungspfad vor der Einführung.

Anwendungsfall 1

Privater multimodaler Dokumentenagent

Führen Sie eine ausgewählte Gemma-Variante auf PDFs, Tabellen, Screenshots und gescannten Beweisen in der genehmigten Umgebung aus. Bewerten Sie Extraktionsgenauigkeit, Zitationen, nicht unterstützte Inferenz, Latenz und Ressourcennutzung.

Anwendungsfall 2

Routing von Edge-to-Cloud-Modellen

Leiten Sie datenschutz- oder latenzempfindliche Aufgaben an eine kleine Gemma-Variante und komplexe Fälle an 31B oder ein Premium-Modell. Messen Sie die Eskalationsqualität, die Gesamtkosten, die Fertigstellung und die Prüfungsschulden.

Anwendungsfall 3

Mehrsprachiger Wissensworkflow

Testen Sie denselben quellbezogenen Prozess in allen Prioritätssprachen, einschließlich gemischtsprachiger Dokumente und mehrdeutiger Terminologie. Messen Sie Genauigkeit, Zitierunterstützung, Sprachdrift und Gutachterkorrektur.

Anwendungsfall 4

Vergleich der offenen Gewichtung der Bereitstellung

Vergleichen Sie zwei Gemma-Größen über eine genehmigte Laufzeit und einen verwalteten Endpunkt hinweg. Berücksichtigen Sie Quantisierung, Speicher, Durchsatz, Sicherheitsschicht, Artefaktherkunft, Patching, Rollback und Gesamtkosten.

Verwandte LLMs

Kuratierte Alternativen zum Vergleich, bevor Sie sich für eine Modellfamilie entscheiden.

Heute starten

Bauen Sie KI-Agenten mit dem passenden Modellen für Beam AI

Erfahren Sie, wie Beam gesteuerte KI-Workflows über die Modellfamilie hinweg orchestrieren kann, die Ihren Anforderungen entspricht.

Heute starten

Bauen Sie KI-Agenten mit dem passenden Modellen für Beam AI

Erfahren Sie, wie Beam gesteuerte KI-Workflows über die Modellfamilie hinweg orchestrieren kann, die Ihren Anforderungen entspricht.

Heute starten

Bauen Sie KI-Agenten mit dem passenden Modellen für Beam AI

Erfahren Sie, wie Beam gesteuerte KI-Workflows über die Modellfamilie hinweg orchestrieren kann, die Ihren Anforderungen entspricht.

Häufig gestellte Fragen

Häufig gestellte Fragen

Fragen zu Modellauswahl, Deployment, Governance und Support von Beam AI beantwortet.

Ist Gemma 4 ein Modell?

Nr. Es handelt sich um eine Familie mit mehreren Größen und Modalitätskonfigurationen. Benchmark-, Kontext-, Hardware- und Bereitstellungsansprüche müssen die genaue Variante benennen, anstatt nur den Familiennamen zu verwenden.

Wie stark ist Gemma 4 31B?

Google meldet starke Aufgaben-Benchmarks, darunter 85,2 auf MMLU-Pro und 89,2 auf AIME 2026. Artificial Analysis berichtet a breiterer Intelligence Index-Wert von 29 für seinen bewerteten 31B-Endpunkt, was ein moderateres unabhängiges Bild zeigt.

Kann Gemma 4 kommerziell genutzt werden?

Google veröffentlicht Gemma 4-Gewichte unter Apache 2.0. Teams sollten dennoch das genaue Repository, die Modellkarte, Hinweise, Abhängigkeiten von Drittanbietern und akzeptable Nutzungsanforderungen überprüfen.

Welche Gemma 4-Größe sollte ein Unternehmen wählen?

Beginnen Sie mit Latenz, Speicher, Datenschutz, Modalität und Qualitätsanforderungen. Bewerten Sie mindestens einen kleinen und einen größeren Kandidaten anhand desselben Tests mit akzeptierten Ergebnissen, anstatt davon auszugehen, dass das größte Modell automatisch das beste ist.

Unterstützt Beam Gemma 4 in der Produktion?

Beam-Unterstützung wird derzeit evaluiert. Für alle Gemma-Größen, -Laufzeiten, -Regionen und -Modalitäten gilt kein pauschaler Anspruch auf Produktionsunterstützung.