Microsoft Phi
Microsoft
Phi-4-reasoning-vision-15B ist ein kompakter Open-Weight-Spezialist für multimodales Reasoning in Mathematik, Naturwissenschaften, Diagrammen und UI-Verständnis. Microsofts veröffentlichte Ergebnisse sind für diese Größe stark, bleiben aber anbieterseitig und machen Phi nicht zum universellen Frontier-Modell.
AKTUELLE MODELL-MOMENTAUFNAHME
Anbieter: Microsoft Research
Aktueller Anker: Phi-4-reasoning-vision-15B
Lebenszyklus: Aktuell
Gewichtungen: Open-weight
Geprüft: 21. Juli 2026

Phis Vorteil ist Spezialisierung pro Parameter
Microsoft hat am 4. März 2026 Phi-4-reasoning-vision-15B veröffentlicht. Das offene Gewichtungsmodell mit 15 Milliarden Parametern kombiniert Text- und Bildargumentation mit besonderem Schwerpunkt auf Mathematik, Naturwissenschaften, Diagrammen und Benutzeroberflächen-Erdung. Es kann zwischen schlussfolgerndem und nicht schlussfolgerndem Verhalten wechseln, anstatt für jede Eingabe lange Ablaufverfolgungen zu erzwingen.
Phi setzt Microsofts Strategie für kleine Sprachmodelle fort: Konzentrieren Sie sich auf Training und Datenqualität, sodass ein kompaktes Modell Aufgaben ausführen kann, die normalerweise einen viel größeren Prüfpunkt erfordern. Der praktische Vorteil besteht in einem geringeren Speicherbedarf, niedrigeren Bereitstellungskosten und einer realistischeren privaten oder Edge-nahen Bereitstellung.
Kompakt bedeutet nicht, dass es universell einsetzbar ist. Der stärkste Beweis des Modells ist domänenförmig, und sein UI-Verständnis sollte nicht mit der Erlaubnis verwechselt werden, beliebige GUI-Aktionen ohne Kontrollen auszuführen.
Die veröffentlichten Ergebnisse sind für 15B stark, aber anbieterseitig
Microsoft meldet 84,8 für AI2D, 83,3 für AI2D ChartQA, 64,4 bei HallusionBench und 44,9 bei MathVerse in seinen Wiederholungen. Das Team veröffentlichte technische Detail- und Bewertungsprotokolle, um die Überprüfbarkeit zu verbessern, aber die Messungen werden weiterhin vom Modellanbieter erstellt.
Diese Aufgaben stimmen mit der Produktthese überein: strukturiertes visuelles Denken, Diagramme, Diagramme und mathematische Inhalte. Sie begründen keine Grenzleistung bei ergebnisoffener Forschung, Agenten mit langer Laufzeit, mehrsprachigen Abläufen oder umfassender geschäftlicher Beurteilung.
Das Modell sollte mit anderen kompakten multimodalen Systemen verglichen werden, nicht nur mit 100B-Plus-Grenzmodellen.
UI-Erdung muss auf Koordinatengenauigkeit, Wiederherstellung veralteter Zustände und destruktive Wirkung getestet werden Prävention.
Begründungs- und Nichtbegründungsmodi sollten hinsichtlich Latenz und Kosten separat verglichen werden.
Der Enterprise-Case: ein fokussiertes Modell für visuelles Reasoning
Phi ist überzeugend für Diagramm- und Diagrammanalysen, UI-Verständnis, wissenschaftliche Dokumente und private multimodale Arbeitsabläufe, bei denen ein 15B-Modell operativ attraktiv ist. Es ist nicht das richtige alleinige Modell für jeden Unternehmensagenten; Die Weiterleitung spezieller visueller Aufgaben an Phi kann glaubwürdiger sein, als von Phi zu verlangen, dass es ein breites Frontier-Modell ersetzt.
Wie wir es bewerten würden
Erstellen Sie einen Testsatz aus echten Diagrammen, gescannten Tabellen, Schnittstellen und Diagrammen, einschließlich gegnerischer Beschriftungen und geändertem UI-Status. Messen Sie die Aufgabengenauigkeit, halluzinierte Elemente, Koordinatenfehler, Wiederherstellung, Latenz, Gedächtnis und Prüfaufwand. Erfordern vor jeder Folgemaßnahme eine Genehmigung.
Verwendete Beweise
Beam AI-Unterstützungsstatus
In Evaluierung. Diese Seite bestätigt keine Beam-Integration, unterstützte Laufzeit oder Berechtigungsmodell für GUI-Aktionen.
Anwendungsfall 1
Diagramm- und Diagrammanalyst
Testen Sie echte Geschäftsdiagramme, wissenschaftliche Zahlen und Diagramme mit irreführenden Legenden und fehlenden Beschriftungen. Bewerten Sie numerische Genauigkeit, nicht unterstützte Behauptungen, Verweise auf visuelle Bereiche, Latenz und Überprüfungszeit.
Anwendungsfall 2
UI-Erdungsassistent
Bewerten Sie das Verständnis von Anwendungs-Screenshots und Formularen bei geänderten Layouts, deaktivierten Steuerelementen und veraltetem Status. Messen Sie Elementidentifikation, Koordinatengenauigkeit, Wiederherstellung und blockierte destruktive Aktionen.
Anwendungsfall 3
Private wissenschaftliche Dokumentenprüfung
Führen Sie das 15B-Modell auf kontrollierten technischen Dokumenten mit Gleichungen und Bildern aus. Verfolgen Sie Extraktion, Argumentationsgenauigkeit, Auslassungen, Halluzinationen, Speichernutzung und Prüferkorrekturen.
Anwendungsfall 4
Kompaktmodell-Router
Leiten Sie visuelle Denkaufgaben an Phi und umfassendere Forschung an ein anderes Modell. Messen Sie Routing-Genauigkeit, End-to-End-Vervollständigung, kombinierte Latenz und Kosten und ob die Spezialisierung die Überprüfungsschuld reduziert.

Verwandte LLMs
Kuratierte Alternativen zum Vergleich, bevor Sie sich für eine Modellfamilie entscheiden.
Häufig gestellte Fragen
Häufig gestellte Fragen
Fragen zu Modellauswahl, Deployment, Governance und Support von Beam AI beantwortet.
Was ist Phi-4-reasoning-vision-15B?
Es ist das kompakte 15B-Open-Weight-Modell von Microsoft für multimodales Denken, insbesondere Mathematik, Naturwissenschaften, Diagramme, Diagramme und UI-Erdung, mit Argumentation und nicht-logischem Verhalten.
Wie stark sind die visuellen Benchmarks von Phi?
Microsoft meldet 84,8 bei AI2D, 83,3 bei ChartQA, 64,4 bei HallusionBench und 44,9 auf MathVerse. Hierbei handelt es sich um vom Anbieter durchgeführte Ergebnisse mit veröffentlichtem technischen Kontext, nicht um unabhängige Produktionsnachweise.
Ist Microsoft Phi Open-Weight?
Ja. Die Modellgewichte werden zum Download veröffentlicht. Überprüfen Sie vor der Bereitstellung die genaue Lizenz, das Repository, die Modellkarte, Hinweise, Laufzeitabhängigkeiten und Artefaktprüfsummen.
Kann Phi Unternehmenssoftware sicher steuern?
Visual Grounding kann UI-Agenten unterstützen, macht autonome Aktionen jedoch nicht sicher. Testkoordinaten, veralteter Status, Berechtigungsgrenzen, Bestätigung, Blockierung von destruktiven Aktionen, Protokollierung und Wiederherstellung.
Unterstützt Beam die Phi-4 Reasoning Vision in der Produktion?
Beam-Unterstützung wird derzeit evaluiert. Diesem Datensatz sind keine genehmigten Laufzeiten, GUI-Steuerungsmuster oder Beam-Benchmarks beigefügt.





