OCR PDF

Trasforma un PDF scansionato in un PDF dentro cui puoi cercare. Tutto in questa scheda, senza account, senza caricare niente e senza limiti di pagine.

Perché un PDF scansionato ha bisogno dell'OCR

Un PDF scansionato è una pila di fotografie. I tuoi occhi lo leggono senza problemi, ma per il computer su quelle pagine ci sono soltanto punti colorati. Ctrl+F non trova niente. Non puoi copiarne una riga. Nulla lo indicizza, quindi più avanti non ricomparirà in nessuna ricerca.

L'OCR — riconoscimento ottico dei caratteri — è il passaggio che cambia le cose. Guarda le forme su ogni pagina, decide di quali lettere si tratta e scrive quelle lettere dentro il file come livello invisibile sotto l'immagine. Dopo l'OCR il PDF ha esattamente lo stesso aspetto; la differenza è che ora sotto c'è del testo.

Il momento che conta arriva di solito mesi dopo. Un contratto che hai scansionato, una fattura, una ricevuta, la pagina di un libro: ti ricordi una frase e nient'altro. Un PDF ricercabile ti restituisce quella frase. Una pila di fotografie no.

Questo strumento di OCR per PDF funziona interamente nel tuo browser. Il file non viene caricato, non c'è nessun account e non c'è alcun tetto al numero di pagine. La pagina che ci precede su questa chiave elabora il tuo file gratis e poi ti chiede di registrarti prima di restituirtelo.

Con caricamentoIl loro server?Questo strumentoIl tuo dispositivoNiente esce dal tuo dispositivo, nessuna copia da cancellare.
Altri convertitori caricano il tuo file su un server. Questo lo disegna dove già si trova.

Che cos'è l'OCR su un PDF?

L'OCR su un PDF è il riconoscimento dei caratteri applicato alle immagini di pagina che contiene, con le parole riconosciute riscritte nello stesso file come livello di testo invisibile: il documento resta identico all'occhio, ma diventa ricercabile, selezionabile e copiabile.

Due tipi di PDF sono identici sullo schermo. Uno è stato esportato da un programma di scrittura e porta testo vero; l'altro viene da uno scanner o dalla fotocamera di un telefono e porta immagini di testo. Solo il secondo ha bisogno dell'OCR.

C'è un modo rapido per distinguerli senza alcuno strumento: prova a selezionare una riga con il mouse. Se un'evidenziazione azzurra segue le parole, il testo c'è già. Se si evidenzia l'intera pagina come un blocco, o non succede niente, hai un PDF scansionato.

Questo strumento fa quel controllo al posto tuo prima di eseguire qualsiasi cosa. Se il file ha già un livello di testo, te lo dice e suggerisce di estrarre il testo, perché l'OCR sostituirebbe qualcosa di esatto con qualcosa di approssimativo — e dopo non avresti modo di accorgertene, visto che la pagina resta identica in ogni caso.

Il testo prodotto dall'OCR va sotto l'immagine della pagina, non sopra. Per questo un PDF ricercabile sembra ancora una scansione: stai sempre guardando l'immagine originale. Il livello invisibile esiste solo per il tuo campo di ricerca, per il comando copia e per qualunque cosa indicizzi il file.

Vale la pena dire chiaramente che cos'è quel livello. È un'ipotesi: ottima su stampa pulita, pessima su una ricevuta spiegazzata fotografata storta. L'immagine che vedi è sempre giusta. Il testo sotto può non esserlo.

Solo immagineInvoiceNo. 4471Total1,240.00+ livello testo
L'OCR non cambia l'aspetto della pagina. Aggiunge un livello di testo sotto l'immagine, ed è quello che rende il PDF ricercabile.

Come fare l'OCR di un PDF in quattro passi

Tutto avviene in questa scheda del browser. Il file non lascia il tuo dispositivo e nessuno ti chiederà un account prima di lasciarti scaricare il risultato.

Lorem ipsumdolor sit ametconsecteturHa testoNiente OCRLorem ipsumSolo alcuneSaltaleSolo immagineEsegui OCR
Non tutti i PDF hanno bisogno dell'OCR. Questo strumento controlla prima di eseguire qualsiasi cosa, perché rileggere un testo già esatto non fa che peggiorarlo.
1

Trascina il tuo PDF scansionato

Trascina il file sul riquadro qui sopra, oppure cliccaci per sfogliare. I file fino a 100 MB vanno bene. Non viene mandato niente da nessuna parte: il file lo apre questa pagina, nel tuo browser.

2

Leggi il verdetto

Lo strumento controlla ogni pagina alla ricerca di un livello di testo prima di fare qualsiasi cosa. Ti dirà se il tuo PDF ha bisogno dell'OCR, se ne ha bisogno solo su alcune pagine, o se non ne ha bisogno affatto. Se solo alcune pagine sono scansioni, le altre restano intatte per impostazione predefinita.

3

Scegli la lingua del documento

La precisione dipende da questo più che da qualsiasi altra cosa tu possa impostare. Scegli la lingua in cui è scritto il documento, non la lingua di questa interfaccia. I dati linguistici vengono scaricati una volta sola — circa 5,2 MB per l'inglese, 1,7 MB per l'hindi — e poi restano in cache. Selezionare più lingue funziona, ma rallenta ogni pagina.

4

Avvia e controlla il risultato

Le pagine vengono elaborate una alla volta, con un'anteprima di quella in lettura, così puoi fermarti subito se hai trascinato il file sbagliato. Alla fine prova a selezionare del testo nell'anteprima. Poi scarica il PDF ricercabile — o il testo semplice, se è tutto ciò che volevi.

Ti servono solo le parole? Se vuoi il testo e non il PDF, e il tuo file ha già un livello di testo, c'è una strada più rapida in cui non si indovina niente: estrarre il testo direttamente dal PDF.

Che cosa fa questo strumento di OCR per PDF

Aggiunge un livello di testo e non cambia nient'altro. Le tue pagine originali restano esattamente come sono: stesse immagini, stessa risoluzione, stessi riquadri di pagina. Le parole riconosciute vengono disegnate sopra con opacità zero, quindi si possono selezionare e cercare ma non si vedono mai. Le pagine che avevano già del testo non vengono riscritte affatto.

Renderizza le pagine a 150 DPI, ed è una scelta misurata, non un valore predefinito. Su un documento di prova, la precisione a 100, 150, 200 e 300 DPI è risultata uguale entro mezzo punto percentuale, mentre 300 DPI impiegava quattro volte tanto. Sotto i 100 DPI c'è un dirupo: a 72 DPI la precisione è scesa dal 95,6% al 79,3%. Scansionare a 600 DPI non renderà l'OCR più preciso. Lo renderà solo più lento.

Gestisce oltre 100 lingue, comprese scritture che la maggior parte dei convertitori salta. Uno degli strumenti di OCR online più noti elenca 19 lingue e nessuna di queste è una scrittura dell'Asia meridionale. Qui hindi, tamil e bengalese sono in elenco, e in alto, perché è lì che si trova davvero la maggior parte di chi cerca questo strumento.

Conta ciò che non è riuscito a fare. Se una pagina torna senza testo — un foglio bianco, una fotografia, della scrittura a mano — resta intatta nel file e viene segnalata. Niente sparisce in silenzio.

Non ti chiede mai di registrarti. Puoi elaborare un documento di 400 pagine e poi un altro. Non c'è un limite giornaliero, perché nessun server fa il lavoro e quindi non c'è niente da razionare.

A cosa serve l'OCR sui PDF:

  • Rendere ricercabili contratti scansionati prima di archiviarli
  • Trovare una riga in un capitolo fotografato pagina per pagina
  • Trasformare una cartella di fatture scansionate in qualcosa di setacciabile
  • Recuperare il testo da un fax o da una fotocopia arrivata in PDF
  • Rendere vecchi documenti scansionati trovabili con la ricerca e non con la memoria
  • Preparare scansioni perché un indice di ricerca o un altro programma possa leggerle
  • Copiare un paragrafo da una scansione invece di riscriverlo a mano

Funziona su qualsiasi dispositivo

Non c'è niente da installare. L'OCR gira nel browser che hai già, quindi lo stesso strumento funziona ovunque e il tuo file resta sul dispositivo da cui è partito.

§ 01

Windows

Chrome, Edge o Firefox. Niente da scaricare e nessun abbonamento Acrobat per rendere ricercabile una scansione.

§ 02

Mac

Safari o Chrome. Anteprima sa mostrarti un PDF scansionato, ma non sa aggiungergli un livello di testo.

§ 03

iPhone e iPad

Funziona in Safari. Comodo quando la scansione è una foto appena scattata, anche se è proprio il caso in cui raddrizzare la pagina conta di più.

§ 04

Android

Funziona in Chrome. I documenti lunghi richiedono tempo e tengono occupato il telefono, quindi mettilo in carica prima.

§ 05

Chromebook

Si adatta bene, perché tutto gira localmente nel browser invece di richiedere un'applicazione installata.

§ 06

Linux

Qualsiasi browser moderno. Niente pacchetti, niente riga di comando, nessuna coda.

Che cosa l'OCR azzecca e che cosa sbaglia

Ogni strumento di OCR commette errori, e quasi nessuno ti dice che aspetto hanno quegli errori. Ecco un risultato reale: una fattura pulita, generata al computer, senza rumore, non storta, con il 95,6% di precisione per carattere in totale. Di dodici parole prese da lì, cinque si riuscivano a trovare cercandole.

Nel fileL'OCR ha lettoNorthwindNorthwindSubtotalSubtotal1741.501741.502089.802089. 80INV-2026INV2026ReplacementRepl acenentPayment isPaymentis5 parole su 12 ricercabili
Da una fattura di prova pulita, con il 95,6% di precisione per carattere. Il nome dell'azienda è passato, il totale no: l'OCR ha infilato uno spazio dentro il numero.
Nel documentoL'OCR ha lettoPerché
NorthwindNorthwindProsa normale in un carattere proporzionale è il caso facile.
2089.802089. 80È comparso uno spazio dentro il numero, quindi cercare il totale non dà nulla.
INV-2026-04471INV2026-04471È caduto un trattino. I numeri di riferimento sono particolarmente fragili.
ReplacementRepl acenentUna m letta come n, più uno spazio che lì non c'è.
Payment isPaymentisL'errore opposto: uno spazio vero è stato eliminato.
1741.501741.50Stessa tabella, stesso carattere del totale qui sopra — e questo è andato bene. Gli errori non sono prevedibili.

Ciò che rovina davvero una scansione

Non è la compressione e non è la risoluzione. Un JPEG a qualità 60 è rimasto a una frazione di punto da un rendering senza perdite. A fare danni è stata l'inclinazione: una pagina storta di due gradi non ha creato problemi, ma a sette gradi la precisione è calata di nove punti e mezzo e la confidenza è scesa da 91 a 74. Se stai scansionando qualcosa, mettilo dritto. Non serve alzare i DPI.

PDF ricercabile, testo semplice o un file Word?

Un PDF ricercabile è ciò che produce questa pagina: la scansione che avevi, più un livello di testo invisibile, e resta un PDF. Il testo semplice sono le parole senza l'impaginazione — utile quando vuoi incollarle altrove, ed è offerto qui come secondo download. Un documento Word modificabile è un altro lavoro, che comporta ricostruire l'impaginazione, e questo strumento non lo fa. Se il tuo PDF ha già del testo e vuoi solo le parole, salta l'OCR ed estraile direttamente.

La tua scansione non lascia questo browser

Il PDF che trascini qui viene aperto da questa pagina, letto dal tuo processore e riscritto dal tuo browser. Non viene caricato, non viene messo in coda su un server e non resta da nessuna parte per un periodo di conservazione, perché nel lavoro non è coinvolto alcun server.

Questo pesa più nell'OCR che nella maggior parte delle conversioni. I documenti che la gente ha bisogno di rendere ricercabili sono contratti, cartelle cliniche, estratti conto e documenti d'identità: esattamente le scansioni che esistono perché valeva la pena conservare l'originale. Ogni grande servizio di OCR online li elabora sulle proprie macchine e li cancella secondo un calendario, di solito dopo una o otto ore.

Significa anche che non c'è niente da razionare. I servizi che fanno il lavoro sul proprio hardware devono limitare l'uso gratuito, ed è per questo che ti fermano a un paio di operazioni al giorno o a dieci pagine per file. Qui il lavoro avviene sul tuo dispositivo, quindi non c'è alcun limite da far rispettare né alcuna registrazione da raccogliere.

§ 01

Non viene caricato niente

Il file viene letto localmente. Su nessun server ne viene creata una copia.

§ 02

Mai un account

Non ti viene chiesto di registrarti per scaricare il risultato, che altrove è il prezzo abituale dell'OCR gratuito.

§ 03

Nessun limite di pagine o di file

Elabora una scansione di 400 pagine, poi un'altra. Non c'è alcuna quota giornaliera.

§ 04

Solo dati linguistici

L'unica cosa scaricata sono i dati di riconoscimento della lingua che scegli. Il tuo documento non fa mai parte di quella richiesta.

Domande frequenti

Questo strumento di OCR per PDF è davvero gratis e c'è un limite di pagine?
È gratis, senza limiti di pagine e senza quota giornaliera. L'OCR gira sul tuo dispositivo invece che su un server, quindi per noi non c'è alcun costo per file e non c'è niente da razionare. I documenti grandi sono limitati solo dalla tua pazienza e dalla tua batteria.
Devo registrarmi per scaricare il risultato?
No. Puoi trascinare un file, eseguire l'OCR e scaricare il PDF ricercabile senza account e senza indirizzo email. Vale la pena verificarlo su qualsiasi sito di OCR prima di caricare qualcosa: è comune che l'account venga chiesto solo al momento del download, a lavoro ormai fatto.
Come faccio a sapere se il mio PDF ha davvero bisogno dell'OCR?
Prova a selezionare una riga di testo con il mouse. Se l'evidenziazione segue le parole, il file ha già un livello di testo e l'OCR lo peggiorerebbe soltanto. Questo strumento controlla automaticamente quando aggiungi un file e ti dice in quale dei tre casi ti trovi prima di eseguire qualsiasi cosa.
Quanto è preciso l'OCR?
Abbastanza preciso da essere utile e non abbastanza da fidarsi a occhi chiusi. Su una fattura di prova pulita, generata al computer, la precisione per carattere era del 95,6% — ma solo 5 parole su 12 prese da lì si riuscivano davvero a trovare cercandole, perché uno spazio finiva dentro un numero o spariva un trattino. La stampa nitida va bene. Tutto ciò che è spiegazzato, sbiadito o storto va peggio.
Quali lingue sono supportate?
Oltre 100, tra cui hindi, tamil, bengalese, thai, vietnamita e indonesiano accanto alle solite lingue europee. Scegli la lingua in cui è scritto il documento, non quella di questa pagina: incide sulla precisione più di qualsiasi altra impostazione. Da notare che le scritture che rimodellano i propri caratteri, come la devanagari, possono perdere qualche parola nel momento in cui viene scritta nel livello di testo del PDF, anche se era stata riconosciuta correttamente.
Legge la scrittura a mano?
Dai per scontato di no. Questo motore è pensato per caratteri stampati, e la scrittura a mano è un altro problema, per il quale non è stato addestrato. Una pagina scritta a mano di solito torna vuota o quasi. Se succede, la pagina resta nel tuo file esattamente com'era e viene segnalata nel riepilogo invece di essere scartata in silenzio.
Il PDF avrà un aspetto diverso dopo?
No, ed è proprio questo il punto. Le immagini delle tue pagine restano esattamente com'erano e il testo riconosciuto viene disegnato sopra con opacità zero. Continui a guardare la scansione originale; il livello di testo esiste solo per il tuo campo di ricerca e per il comando copia.
Una scansione a DPI più alti dà risultati OCR migliori?
Di solito no. Nei test, la precisione a 100, 150, 200 e 300 DPI è risultata identica entro mezzo punto percentuale, mentre 300 DPI impiegava quattro volte tanto. C'è un pavimento — a 72 DPI la precisione è crollata al 79,3% — ma sopra i 150 DPI circa stai pagando tempo per niente. Raddrizzare la pagina aiuta molto di più.
Quanto ci mette?
Circa un secondo a pagina su un portatile normale per una pagina A4 standard, quindi un documento di 50 pagine si aggira sul minuto. I telefoni sono più lenti. Selezionare più lingue moltiplica il lavoro, quindi scegli solo quelle che sono davvero nel documento.
Il mio file viene caricato da qualche parte?
No. Il PDF viene aperto ed elaborato dentro questa scheda e non viene mai mandato a un server. L'unica richiesta di rete che lo strumento fa riguarda i dati di riconoscimento della lingua che hai scelto: è lo stesso file per tutti e non contiene nulla di tuo.
Qual è la differenza rispetto a «PDF in testo»?
Questa pagina costruisce un PDF ricercabile a partire da una scansione, indovinando i caratteri presenti nelle immagini. «PDF in testo» estrae il testo che è già nel file, in modo esatto e senza indovinare niente. Se il tuo PDF ha un livello di testo, è quello lo strumento che vuoi: è più veloce e non può commettere il tipo di errori che commette l'OCR.
Posso ottenere invece un documento Word modificabile?
Non da questo strumento. Trasformare una scansione in un file Word significa ricostruire l'impaginazione — colonne, tabelle, titoli — ed è un altro lavoro, con i suoi modi di fallire. Qui ottieni il PDF originale reso ricercabile, più un download in testo semplice se vuoi le parole da sole.

Rendi ricercabile il tuo PDF scansionato

Gratis, illimitato e gira in questa scheda. Nessun caricamento, nessuna registrazione — e ti avvisa se il tuo file non ha bisogno dell'OCR.

Fai l'OCR di un PDF