OCR

Perché non riesco a cercare dentro il mio PDF scansionato?

Perché una scansione è un'immagine, non testo. Per il tuo dispositivo quella pagina è una fotografia: non ci sono parole da cercare. L'OCR — riconoscimento ottico dei caratteri — analizza l'immagine, identifica le lettere e aggiunge dietro uno strato di testo invisibile. La pagina resta identica, ma diventa ricercabile e copiabile.

Da cosa dipende la precisione

Da risoluzione e contrasto, molto più che dal programma. 300 dpi è la soglia in cui l'OCR funziona bene; sotto i 200 gli errori si moltiplicano. Una foto scattata storta e con un'ombra dà risultati peggiori di una scansione mediocre ma dritta.

Raddrizzare la pagina prima dell'elaborazione migliora il risultato più che cambiare strumento.

Dove fallisce sempre

Scrittura a mano, caratteri decorativi, testo su sfondi a motivi e tabelle piene di linee. Anche i documenti in più lingue: se il motore è impostato su una sola lingua, le parole dell'altra escono sbagliate.

I numeri sono il caso più delicato. Uno 0 letto come O in un importo non salta all'occhio e cambia il significato. Se il documento è contabile o legale, verifica le cifre a mano.

Il testo riconosciuto non sostituisce l'originale

Lo strato OCR è un aiuto alla ricerca, non una trascrizione certificata. Per una pratica ufficiale vale la scansione, non ciò che un programma ha creduto di leggere.

PDF Studio – Reader & Tools

La nostra app iOS proprio per questo. Gira sul tuo dispositivo — nessun account, nessun tracciamento.

Vedi l'app →