Skan może wyglądać czytelnie, a mimo to nie zawierać tekstu do wyszukiwania. NAPS2 potrafi dodać rozpoznany tekst do takich stron PDF. Sam obraz nie dowodzi poprawnego rozpoznania nazw, liczb ani kolejności czytania.
Zachowaj oryginał i sprawdź strony
Pracuj na kopii i zachowaj oryginalny PDF. Zaimportuj kopię do NAPS2. Sprawdź liczbę, kolejność i orientację stron. Przy uciętych wierszach, mocnych cieniach lub rozmyciu lepszy skan często pomaga bardziej niż ponowne OCR. Poradnik dotyczy skanów, nie zachowania formularzy interaktywnych lub podpisów cyfrowych.
Ustaw OCR i zapisz PDF
- Otwórz przycisk OCR w NAPS2; na Macu dokumentacja wskazuje Tools, OCR.
- Przy pierwszym użyciu pobierz potrzebny język. Wybierz język dokumentu, nie automatycznie język interfejsu.
- Włącz tworzenie PDF z tekstem wyszukiwalnym przez OCR. Dla wielu języków pobierz pakiety i wybierz języki dokumentu.
- Zapisz nowy PDF pod odróżnialną nazwą. Nie nadpisuj oryginału; poczekaj na koniec rozpoznawania i zapisu.
NAPS2 zwykle wykonuje OCR podczas zapisywania. Best może poprawić wyniki względem Fast, lecz trwa dłużej. Opcje balansu bieli i szumu mogą pomóc słabym skanom; nadal sprawdź wynik.
Odczytaj zapisany wynik
Zamknij zapisany PDF i otwórz dokładnie ten plik w czytniku PDF. Wyszukaj charakterystyczne słowo na stronie początkowej i końcowej. Skopiuj akapit do lokalnego edytora tekstowego i porównaj go z obrazem.
Sprawdź szczególnie nazwy, polskie znaki, daty, separatory dziesiętne i pomyłki O/0 lub I/1. Skontroluj kolejność kolumn i tabel. Ważne kwoty i identyfikatory wymagają pełnej kontroli; próbki nie potwierdzają wszystkich stron. Wynik wyszukiwania dowodzi tylko tego trafienia.
Istniejący tekst i ograniczenia
Dokumentacja mówi, że NAPS2 pozostawia bez zmian importowane strony już zawierające tekst, a stosuje OCR na stronach bez tekstu. Ponowny import nie poprawia więc automatycznie istniejącej błędnej warstwy. Ustal, które strony są naprawdę samym obrazem, zamiast wielokrotnie przetwarzać ten sam plik.
OCR nie tłumaczy i nie zapewnia automatycznie dostępności PDF ani poprawnego formatowania tekstu. NAPS2 nie eksportuje wyników OCR bezpośrednio do pliku tekstowego; udokumentowana droga to zapis PDF i kopiowanie w czytniku. Zachowaj oryginał i opisz nierozwiązane błędy przed udostępnieniem.
