Jedes Dokument, das Sie in Blast Audit importieren, durchläuft die OCR (optische Zeichenerkennung). Die OCR findet jedes Wort auf der Seite und hält fest, wo es steht. Snips, die Suche in der Dokumentenansicht, der Dokumentenabgleich und die Extraktion arbeiten alle mit diesem Text, ein Dokument muss also die OCR abschließen, bevor Sie es nutzen können. Es gibt keine Einstellung, die OCR zu überspringen.
Wie ein Dokument gelesen wird
Blast Audit wählt die Methode für jedes Dokument beim Import.
| Dokument | Methode | Angezeigt als |
|---|---|---|
| PDF, das bereits Text enthält (aus Buchhaltungssoftware, Bankportal oder Word exportiert) | Der Text wird direkt aus dem PDF gelesen. Das dauert Sekunden. | PDF-Text |
| Scan, Foto oder PDF ohne Text | Die Seitenbilder werden per visueller OCR gelesen. Das dauert länger. | Visuelle OCR |
Bei einem PDF, das aus seinem eigenen Text gelesen wurde, zeigt die Seite Dokumente: „Dokument bereit: Der Text wurde direkt aus der PDF gelesen. Verwenden Sie die visuelle OCR nur, wenn Snips falsch sind oder fehlen.“ Manche PDFs enthalten versteckten Text, der nicht zur Seite passt. Klicken Sie in diesem Fall auf die Schaltfläche ⋮ am Ende der Zeile des Dokuments und dann auf Visuelle OCR ausführen.
Den Fortschritt verfolgen
Beim Import von Dokumenten durchläuft der Aufgabenbereich Dateien hochladen, Vorbereitung und Dokumente lesen. Lassen Sie Excel geöffnet und bleiben Sie auf der Seite Dokumente, bis es abgeschlossen ist. Wenn Sie den Import verlassen, kann das OCR-Ergebnis verloren gehen, und Sie müssen die OCR erneut ausführen.
Die Spalte OCR-Status zeigt, wo jedes Dokument steht:
| Status | Bedeutung |
|---|---|
| Nicht gestartet / OCR erforderlich | Die OCR ist nicht gelaufen. Klicken Sie auf OCR starten. |
| In Warteschlange | Wartet, bis es an der Reihe ist. |
| In Bearbeitung | Wird gelesen. |
| Abgeschlossen | Bereit für Snips, Abgleich und Extraktion. |
| OCR fehlgeschlagen | Klicken Sie im Menü ⋮ des Dokuments auf OCR erneut ausführen. |
OCR erneut ausführen liest das Dokument noch einmal mit visueller OCR. Schlägt ein erneuter Lauf fehl, behält Blast Audit das vorherige Ergebnis.
OCR-Kontingent
Die visuelle OCR zählt Seiten gegen ein monatliches Kontingent, das alle in Ihrer Organisation gemeinsam nutzen: etwa 10.000 Seiten pro Benutzer und Monat, gebündelt. Ein PDF, dessen Text beim Import vollständig lesbar ist, überspringt die OCR und zählt nicht. Braucht ein Dokument OCR, zählen alle seine Seiten. Ist das Kontingent erreicht, teilt der Aufgabenbereich es mit, und die nicht verarbeiteten Dokumente bleiben auf OCR erforderlich. Fragen Sie Ihren Administrator nach der Nutzung Ihrer Organisation. Das Kontingent gehört zu Ihren Lizenzen: siehe Tarif wählen, Lizenzen kaufen oder Angebot anfordern.
Wo die OCR läuft
Die visuelle OCR läuft auf Microsoft Azure. Wo Ihre Daten gespeichert werden erklärt, wo Dokumente verarbeitet werden und wie lange sie aufbewahrt werden.
Verwandte Probleme
Wenn die OCR auf In Bearbeitung bleibt, fehlschlägt oder keinen Text findet, siehe OCR hängt, ist langsam oder fehlgeschlagen.