Estrai il testo da un'immagine (OCR)

Riconosci il testo da una foto, uno screenshot o un PDF scansionato e copialo o scaricalo in .txt. Funziona anche in italiano. Tutto avviene nel tuo browser.

🔎 Tocca qui o trascina un'immagine o un PDF

JPG, PNG, WEBP o PDF scansionato

⬇️ Scarica .txt

🔒 Privacy totale: l'immagine e il riconoscimento avvengono sul tuo dispositivo, senza caricare nulla online.

Che cos'è l'OCR

L'OCR (riconoscimento ottico dei caratteri) trasforma il testo «disegnato» in un'immagine in testo vero, che puoi copiare e modificare. È perfetto per documenti scansionati, foto di pagine, screenshot, cartelli o etichette.

Consigli per un buon risultato

Usa immagini nitide e ben illuminate, con il testo dritto e un buon contrasto tra scritta e sfondo. Scegli la lingua giusta: se il documento è in italiano, seleziona «Italiano» per la massima precisione. Il primo avvio scarica il modello di riconoscimento (una sola volta), poi resta in memoria. Se la foto del documento è storta, prima conviene passare da Raddrizza un documento.

Che cosa fa fallire un riconoscimento

Quattro cose, in ordine di gravità. La risoluzione: sotto una certa dimensione le lettere non hanno abbastanza pixel per essere distinte, e la regola pratica è che il testo deve essere alto almeno venti pixel. L'inclinazione: pochi gradi di storto abbassano molto la resa, perché il programma cerca righe orizzontali.

Poi il contrasto, cioè quanto la scritta si stacca dal fondo: una fotocopia sbiadita o una foto con l'ombra della mano sopra danno risultati pessimi. E infine il carattere: i font decorativi, il corsivo e la scrittura a mano sono un altro problema, che gli strumenti tradizionali non affrontano nemmeno.

Come fotografare un documento perché funzioni

Alla luce diffusa, mai con il flash e mai con una lampada di lato: le ombre e i riflessi sono la causa numero uno dei riconoscimenti sbagliati. Il telefono va tenuto parallelo al foglio, non inclinato, perché la prospettiva stringe le righe lontane e le rende illeggibili.

Se il foglio è su un tavolo, conviene appoggiarlo su una superficie di colore diverso e riempire l'inquadratura con il solo documento: quello che sta intorno non serve e confonde. E se la foto è già stata scattata storta, prima di riconoscere il testo va raddrizzata: è il passaggio che da solo cambia più risultati.

Che cosa controllare nel testo che esce

I riconoscimenti sbagliati sono sempre gli stessi, e si trovano in fretta se si sa dove guardare: 0 e O, 1 e l e I, 5 e S, 8 e B, rn letto come m. Sono errori che una rilettura distratta non coglie, perché il testo resta plausibile.

Il punto in cui contano davvero è nei numeri: un IBAN, un codice fiscale, un importo, una data. Lì un carattere sbagliato non si vede e produce un danno, quindi ogni sequenza numerica va confrontata a mano con l'immagine. Il testo discorsivo, al contrario, si può correggere leggendo.

I limiti, detti con chiarezza

La scrittura a mano non viene riconosciuta dagli strumenti classici, e nemmeno da questo: serve un modello addestrato apposta, e anche quelli sbagliano molto più che sul testo stampato. Le tabelle perdono la struttura: le celle diventano righe di testo in fila, e ricostruire le colonne è un lavoro a parte.

E l'impaginazione non sopravvive: le colonne di un giornale, le note a piè di pagina e i riquadri escono mescolati nell'ordine in cui il programma li incontra. Quello che si ottiene è il contenuto, non il documento.

Gli strumenti vicini

Se la foto è storta, prima serve Raddrizza un documento fotografato. Per un PDF che ha già il testo dentro c'è Estrai il testo da un PDF, e per cercare dentro tanti PDF Cerca una parola dentro tanti PDF. Sul testo ottenuto lavorano Contatore di parole e Ripara i caratteri strani.