Guide & Tutorial

OCR: come riconoscere il testo di un documento scansionato

L'OCR trasforma l'immagine di una pagina in testo vero: selezionabile, ricercabile e modificabile. Qui il riconoscimento avviene interamente sul tuo computer, senza inviare la scansione a nessun servizio.

1. Che cos'è l'OCR

OCR sta per Optical Character Recognition, riconoscimento ottico dei caratteri: è la tecnologia che guarda l'immagine di una pagina e ne ricava il testo, lettera per lettera.

Serve perché una scansione, per il computer, non è un documento ma una fotografia. Le parole che tu leggi benissimo, per il software sono soltanto chiaroscuri: non si possono selezionare, cercare, copiare né correggere.

L'OCR colma esattamente questo scarto. Dopo il riconoscimento la pagina contiene testo vero e il documento torna a comportarsi come un PDF normale.

🔒
In 123 PDF Editor PRO l'OCR gira con un motore integrato nel browser: la scansione non viene caricata su alcun server, nemmeno durante il riconoscimento. È una differenza sostanziale rispetto ai servizi OCR online, dove il documento — spesso un atto, una fattura o una carta d'identità — viene inviato a un'infrastruttura di terzi.

🔍 2. Quando serve davvero

Non tutti i PDF hanno bisogno dell'OCR. C'è un modo semplice per capirlo in due secondi.

Prova a selezionare una parola con il mouse. Se il testo si evidenzia, il documento contiene già testo vero e l'OCR è inutile. Se invece il cursore ti fa selezionare un rettangolo come su una foto, hai davanti una scansione.

  • Documenti cartacei passati allo scanner o fotografati con il telefono.
  • Fax, ricevute e moduli archiviati anni fa in formato immagine.
  • PDF generati da vecchi sistemi gestionali che stampano su immagine.
  • Screenshot e foto di pagine inserite dentro un PDF.

3. Eseguire l'OCR

L'editor riconosce da solo le pagine prive di testo e propone il riconoscimento, ma puoi anche avviarlo tu quando vuoi.

L'editor rileva le pagine scansionate e propone l'OCR
Le pagine senza testo selezionabile vengono rilevate automaticamente.
  1. Installa l'estensione dalla pagina di download; è un'estensione per Chrome e funziona uguale su Windows, Mac e Linux.
  2. Apri il documento con Scegli un PDF (o Apri PDF).
  3. Se compare la finestra Pagine scansionate rilevate, procedi da lì; altrimenti apri OCR locale dalla barra degli strumenti.
  4. Scegli la lingua del documento, oppure lascia Automatic.
  5. Clicca Avvia OCR locale e attendi il completamento della barra di avanzamento.
  6. Al termine il testo è selezionabile: puoi correggerlo, cercarlo e copiarlo.
Il testo di un PDF scansionato diventa modificabile dopo l'OCR
Dopo il riconoscimento la scansione piatta diventa testo modificabile e ricercabile.

🌐 4. Le lingue riconosciute

Sono incluse 10 lingue, tutte disponibili offline: non serve scaricare nulla al momento dell'uso.

  1. Se conosci la lingua del documento, selezionala: il riconoscimento è più rapido e più preciso.
  2. Se il documento è misto o non sei sicuro, lascia Automatic: vengono caricate tutte le lingue incluse.
  3. L'opzione automatica richiede più tempo e più memoria, quindi conviene usarla solo quando serve davvero.
💡
La lingua incide soprattutto sulle lettere accentate e sui caratteri simili fra loro. Indicare l'italiano su un documento italiano evita gran parte degli errori su à, è, ì, ò, ù.

5. Come ottenere un buon risultato

La qualità dell'OCR dipende quasi interamente dalla qualità della scansione di partenza: nessun motore recupera ciò che nell'immagine non c'è.

  • Risoluzione adeguata — una scansione a 300 DPI è lo standard di riferimento per il testo; sotto i 200 DPI gli errori aumentano molto.
  • Pagina dritta — se la scansione è storta, raddrizzala prima con la rotazione delle pagine.
  • Buon contrasto — testo nero su fondo bianco funziona meglio di una fotocopia sbiadita o di una foto in penombra.
  • Testo stampato — l'OCR legge i caratteri a stampa; la scrittura a mano resta fuori portata.
  • Rileggi sempre — su numeri, codici fiscali e importi conviene un controllo manuale: un 0 letto come O passa facilmente inosservato.

6. Cosa puoi fare dopo il riconoscimento

Una volta che il testo esiste, il documento si comporta come qualsiasi altro PDF.

  1. Correggere e aggiornare il testo: vedi la guida su come modificare il testo di un PDF.
  2. Cercare una parola in tutto il documento, cosa impossibile su una scansione.
  3. Evidenziare i passaggi importanti, come spiegato nella guida su come evidenziare un PDF.
  4. Rimuovere dati riservati in modo effettivo, seguendo la guida su come oscurare il testo.
  5. Archiviare il documento reso ricercabile, così da ritrovarlo in futuro cercando una parola.

? 7. Domande frequenti

Le domande che ricorrono più spesso su questo argomento.

L'OCR funziona senza connessione a internet?

Sì. Il motore di riconoscimento è incluso nell'estensione e lavora in locale: puoi eseguire l'OCR anche completamente offline.

Quanto tempo richiede?

Dipende dal numero di pagine, dalla risoluzione e dal computer. Poche pagine sono questione di secondi; un documento lungo scansionato ad alta risoluzione richiede più pazienza, soprattutto con l'opzione automatica su tutte le lingue.

Il testo riconosciuto è identico all'originale?

Quasi sempre molto vicino, ma nessun OCR è infallibile. Su documenti importanti rileggi almeno le parti numeriche e i nomi propri.

La versione gratuita mette una filigrana sugli export OCR?

Le esportazioni OCR della versione gratuita riportano una piccola scritta “Free Version”. La licenza PRO, un pagamento unico di $24, la rimuove insieme ai limiti su download e progetti.

Rendi leggibile la tua scansione

Installa l'estensione, apri il documento e avvia il riconoscimento — senza inviare la scansione online.