Tee skannatusta PDF:stä haettava NAPS2:lla ja tarkista OCR-teksti

Skannaus voi näyttää luettavalta sisältämättä haettavaa tekstiä. NAPS2 voi lisätä tunnistetun tekstin tällaisille PDF-sivuille. Pelkkä kuva ei todista nimien, lukujen tai lukujärjestyksen tunnistamista oikein.

Säilytä alkuperäinen ja tarkista sivut

Työskentele kopiolla ja säilytä alkuperäinen PDF. Tuo kopio NAPS2:een. Tarkista sivumäärä, järjestys ja suunta. Katkenneet rivit, voimakkaat varjot tai epätarkat merkit korjaantuvat usein paremmin uudella skannauksella kuin uudella OCR-kierroksella. Ohje koskee skannauksia, ei interaktiivisten lomakkeiden tai digitaalisten allekirjoitusten säilyttämistä.

Aseta OCR ja tallenna PDF

  1. Avaa NAPS2:n OCR-painike; Macissa dokumentaatio ohjaa kohtaan Tools, OCR.
  2. Lataa tarvittava tunnistuskieli ensimmäisellä käyttökerralla. Valitse asiakirjan kieli, älä automaattisesti käyttöliittymän kieltä.
  3. Ota käyttöön PDF:n haettavaksi tekevä OCR-asetus. Monikielistä asiakirjaa varten lataa kielipaketit ja valitse useita kieliä.
  4. Tallenna uusi PDF erottuvalla nimellä. Älä korvaa alkuperäistä; odota tunnistuksen ja tallennuksen valmistumista.

NAPS2 suorittaa OCR:n yleensä tallennettaessa. Best voi parantaa tulosta Fast-tilaan verrattuna, mutta kestää kauemmin. Valkotasapaino- ja kohina-asetukset voivat auttaa heikkoja skannauksia; tarkista tulos silti.

Lue tallennettu tulos

Sulje tallennettu PDF ja avaa juuri se tiedosto PDF-lukijassa. Hae tunnusomaista sanaa alku- ja loppupään sivulta. Kopioi kappale paikalliseen tekstieditoriin ja vertaa sitä kuvaan.

Tarkista erityisesti nimet, ääkköset, päivämäärät, desimaalierottimet sekä sekaannukset O/0 ja I/1. Tarkista palstojen ja taulukoiden järjestys. Tärkeät summat ja tunnisteet on tarkistettava kokonaan; otokset eivät vahvista joka sivua. Hakutulos todistaa vain kyseisen osuman.

Olemassa oleva teksti ja rajat

Dokumentaation mukaan NAPS2 jättää tekstiä jo sisältävät tuodut sivut ennalleen ja käyttää OCR:ää tekstittömille sivuille. Uudelleentuonti ei siksi automaattisesti korjaa olemassa olevaa väärää tekstikerrosta. Selvitä aidosti pelkkää kuvaa sisältävät sivut sen sijaan, että käsittelisit samaa tiedostoa toistuvasti.

OCR ei käännä eikä tee PDF:stä automaattisesti saavutettavaa tai tekstistä oikein muotoiltua. NAPS2 ei vie OCR-tuloksia suoraan tekstitiedostoon; dokumentoitu tapa on tallentaa PDF ja kopioida lukijassa. Säilytä alkuperäinen ja kirjaa ratkaisemattomat virheet ennen jakamista.

Lähde

NAPS2: OCR documentation