So funktioniert die OCR und warum jedes Dokument sie braucht

Warum jedes importierte Dokument die OCR durchläuft, PDF-Text oder visuelle OCR, was die Spalte OCR-Status bedeutet und wie das OCR-Kontingent funktioniert.

Jedes Dokument, das Sie in Blast Audit importieren, durchläuft die OCR (optische Zeichenerkennung). Die OCR findet jedes Wort auf der Seite und hält fest, wo es steht. Snips, die Suche in der Dokumentenansicht, der Dokumentenabgleich und die Extraktion arbeiten alle mit diesem Text, ein Dokument muss also die OCR abschließen, bevor Sie es nutzen können. Es gibt keine Einstellung, die OCR zu überspringen.

Wie ein Dokument gelesen wird

Blast Audit wählt die Methode für jedes Dokument beim Import.

DokumentMethodeAngezeigt als
PDF, das bereits Text enthält (aus Buchhaltungssoftware, Bankportal oder Word exportiert)Der Text wird direkt aus dem PDF gelesen. Das dauert Sekunden.PDF-Text
Scan, Foto oder PDF ohne TextDie Seitenbilder werden per visueller OCR gelesen. Das dauert länger.Visuelle OCR

Bei einem PDF, das aus seinem eigenen Text gelesen wurde, zeigt die Seite Dokumente: „Dokument bereit: Der Text wurde direkt aus der PDF gelesen. Verwenden Sie die visuelle OCR nur, wenn Snips falsch sind oder fehlen.“ Manche PDFs enthalten versteckten Text, der nicht zur Seite passt. Klicken Sie in diesem Fall auf die Schaltfläche ⋮ am Ende der Zeile des Dokuments und dann auf Visuelle OCR ausführen.

Den Fortschritt verfolgen

Beim Import von Dokumenten durchläuft der Aufgabenbereich Dateien hochladen, Vorbereitung und Dokumente lesen. Lassen Sie Excel geöffnet und bleiben Sie auf der Seite Dokumente, bis es abgeschlossen ist. Wenn Sie den Import verlassen, kann das OCR-Ergebnis verloren gehen, und Sie müssen die OCR erneut ausführen.

Die Spalte OCR-Status zeigt, wo jedes Dokument steht:

StatusBedeutung
Nicht gestartet / OCR erforderlichDie OCR ist nicht gelaufen. Klicken Sie auf OCR starten.
In WarteschlangeWartet, bis es an der Reihe ist.
In BearbeitungWird gelesen.
AbgeschlossenBereit für Snips, Abgleich und Extraktion.
OCR fehlgeschlagenKlicken Sie im Menü ⋮ des Dokuments auf OCR erneut ausführen.

OCR erneut ausführen liest das Dokument noch einmal mit visueller OCR. Schlägt ein erneuter Lauf fehl, behält Blast Audit das vorherige Ergebnis.

OCR-Kontingent

Die visuelle OCR zählt Seiten gegen ein monatliches Kontingent, das alle in Ihrer Organisation gemeinsam nutzen: etwa 10.000 Seiten pro Benutzer und Monat, gebündelt. Ein PDF, dessen Text beim Import vollständig lesbar ist, überspringt die OCR und zählt nicht. Braucht ein Dokument OCR, zählen alle seine Seiten. Ist das Kontingent erreicht, teilt der Aufgabenbereich es mit, und die nicht verarbeiteten Dokumente bleiben auf OCR erforderlich. Fragen Sie Ihren Administrator nach der Nutzung Ihrer Organisation. Das Kontingent gehört zu Ihren Lizenzen: siehe Tarif wählen, Lizenzen kaufen oder Angebot anfordern.

Wo die OCR läuft

Die visuelle OCR läuft auf Microsoft Azure. Wo Ihre Daten gespeichert werden erklärt, wo Dokumente verarbeitet werden und wie lange sie aufbewahrt werden.

Verwandte Probleme

Wenn die OCR auf In Bearbeitung bleibt, fehlschlägt oder keinen Text findet, siehe OCR hängt, ist langsam oder fehlgeschlagen.

Noch nicht gelöst?

Schreiben Sie dem Team, was Sie versucht haben, und wenn möglich einen Screenshot dessen, was Sie sehen.

Support anschreiben