Google Cloud Vision Logo

By submitting, you consent to our use of your data. Privacy Policy.

Kategorie

Geschäftsführung

Erstellt von

Beam.ai

AI-Agenten-Integrationen

Google Cloud Vision Logo

Google Cloud Vision

AI-Agenten-Integrationen

Google Cloud Vision

Scannen Sie hochgeladene Belege nach Lieferantennamen und Gesamtsummen und übertragen Sie die Felder anschließend in das Spesenabrechnungssystem – so automatisieren Sie die Dateneingabe, die Finanzteams andernfalls Zeile für Zeile manuell erledigen müssten.

Erfassung von Beleg- und Rechnungstexten

Cloud Vision liest gedruckten und handschriftlichen Text aus einem Bild mithilfe der vortrainierten Modelle von Google. Ein Beam-Agent scannt das Bild eines hochgeladenen Belegs oder einer Rechnung, erfasst den Namen des Anbieters, das Datum sowie den Gesamtbetrag und trägt diese Felder in das Spesen- oder Buchhaltungssystem ein, sofern dort noch kein entsprechender Datensatz existiert. Vor der Buchung gleicht er den erfassten Betrag mit der Datei ab. Bilder, die unscharf oder abgeschnitten sind oder bei denen das Modell eine geringe Erkennungsgenauigkeit liefert, werden aussortiert, woraufhin ein Mitarbeiter des Finanzteams das Originalbild öffnet, um die Daten manuell einzugeben.

Objekt- und Label-Erkennung

Cloud Vision kann erkennen, welche Objekte, Szenen oder Labels auf einem Foto zu sehen sind. Ein Beam-Agent liest ein neu hochgeladenes Foto – wie ein Produktbild oder ein Foto einer Standortbegehung – ab, gleicht es mit einer von einem Team genehmigten Liste von Labels ab (z. B. Beschädigung, fehlende Sicherheitsausrüstung oder eine bestimmte Produktkategorie) und taggt den Datensatz entsprechend in dem System, aus dem er stammt. Es werden nur Labels angewendet, die sich bereits auf der genehmigten Liste befinden. Fotos, bei denen kein Label den erforderlichen Konfidenzwert erreicht oder bei denen mehrere widersprüchliche Labels zutreffen, werden einer Person zur manuellen Kategorisierung vorgelegt.

Erkennung unsicherer Inhalte

Cloud Vision kann ein Bild anhand der Safe-Search-Kategorien von Google auf jugendgefährdende, gewalttätige oder anderweitig unsichere Inhalte überprüfen. Ein Beam-Agent liest ein Bild in dem Moment aus, in dem es in einen öffentlichen Bereich hochgeladen wird, beispielsweise auf eine Community-Seite oder in eine Produktauflistung, und gleicht es mit dem Safe-Search-Ergebnis ab. Bilder, die eindeutig in eine Kategorie fallen, die laut Unternehmensrichtlinie als unsicher eingestuft wird, werden von der öffentlichen Anzeige ausgeschlossen, noch bevor sie live gehen. Alles, was das Modell als möglich, aber nicht sicher einstuft, oder eine Kategorie, die von der Richtlinie nicht eindeutig abgedeckt wird, wird einem Moderator zur Entscheidung vorgelegt.

Beginnen Sie noch heute

Starten Sie mit KI-Agenten zur Automatisierung von Prozessen

Nutzen Sie jetzt unsere Plattform und beginnen Sie mit der Entwicklung von KI-Agenten für verschiedene Arten von Automatisierungen

Beginnen Sie noch heute

Starten Sie mit KI-Agenten zur Automatisierung von Prozessen

Nutzen Sie jetzt unsere Plattform und beginnen Sie mit der Entwicklung von KI-Agenten für verschiedene Arten von Automatisierungen

Beginnen Sie noch heute

Starten Sie mit KI-Agenten zur Automatisierung von Prozessen

Nutzen Sie jetzt unsere Plattform und beginnen Sie mit der Entwicklung von KI-Agenten für verschiedene Arten von Automatisierungen