Każdy dokument, który importujesz do Blast Audit, przechodzi OCR (optyczne rozpoznawanie znaków). OCR znajduje każde słowo na stronie i zapisuje, gdzie się znajduje. Snipy, wyszukiwanie w przeglądarce, dopasowywanie dokumentów i ekstrakcja działają na tym tekście, dlatego dokument musi zakończyć OCR, zanim będzie można z niego korzystać. Nie ma ustawienia pozwalającego pominąć OCR.
Jak odczytywany jest dokument
Blast Audit wybiera metodę dla każdego dokumentu przy imporcie.
| Dokument | Metoda | Wyświetlane jako |
|---|---|---|
| PDF, który już zawiera tekst (wyeksportowany z programu księgowego, portalu banku, Worda) | Tekst jest odczytywany bezpośrednio z PDF. Trwa to kilka sekund. | Tekst PDF |
| Skan, zdjęcie lub PDF bez tekstu | Obrazy stron są odczytywane przez OCR wizualny. Trwa to dłużej. | OCR wizualny |
Dla PDF odczytanego z własnego tekstu strona Dokumenty pokazuje: „Dokument jest gotowy: tekst odczytano bezpośrednio z pliku PDF. Użyj OCR wizualnego tylko wtedy, gdy niektóre snipy wyglądają błędnie lub ich brakuje.” Niektóre PDF zawierają ukryty tekst, który nie zgadza się ze stroną. W takim przypadku kliknij przycisk ⋮ na końcu wiersza dokumentu, a następnie Uruchom OCR wizualny.
Śledź postęp
Gdy importujesz dokumenty, okienko przechodzi przez Przesyłanie plików, Przygotowywanie i Odczytywanie dokumentów. Nie zamykaj Excela i pozostań na stronie Dokumenty do końca. Jeśli opuścisz ją podczas importu, wynik OCR może zostać utracony i trzeba będzie uruchomić OCR ponownie.
Kolumna Status OCR pokazuje, na jakim etapie jest każdy dokument:
| Status | Znaczenie |
|---|---|
| Nie rozpoczęto / Wymagane OCR | OCR nie został uruchomiony. Kliknij Uruchom OCR. |
| W kolejce | Czeka na swoją kolej. |
| Przetwarzanie | Jest odczytywany. |
| Ukończono | Gotowy do snipów, dopasowywania i ekstrakcji. |
| OCR nie powiódł się | Kliknij Uruchom OCR ponownie w menu ⋮ dokumentu. |
Uruchom OCR ponownie odczytuje dokument jeszcze raz za pomocą OCR wizualnego. Jeśli ponowne uruchomienie się nie powiedzie, Blast Audit zachowuje poprzedni wynik.
Limit OCR
OCR wizualny zlicza strony w miesięcznym limicie wspólnym dla wszystkich w Twojej organizacji: około 10 000 stron na użytkownika miesięcznie, łącznie. PDF, którego tekst jest w pełni czytelny przy imporcie, pomija OCR i nie jest liczony. Gdy dokument wymaga OCR, liczone są wszystkie jego strony. Gdy limit zostanie osiągnięty, okienko Cię o tym informuje, a nieprzetworzone dokumenty pozostają w stanie Wymagane OCR. Zapytaj administratora o wykorzystanie w Twojej organizacji. Limit wynika z Twoich licencji: zobacz Wybór planu, zakup licencji i wycena.
Gdzie działa OCR
OCR wizualny działa w Microsoft Azure. Gdzie przechowujemy dane i jak długo wyjaśnia, gdzie dokumenty są przetwarzane i jak długo są przechowywane.
Powiązane problemy
Jeśli OCR pozostaje w stanie Przetwarzanie, kończy się niepowodzeniem albo nie znajduje tekstu, zobacz OCR zawieszony, wolny lub zakończony błędem.