OCR PDF
Trasforma un PDF scansionato in un PDF dentro cui puoi cercare. Tutto in questa scheda, senza account, senza caricare niente e senza limiti di pagine.
Trascina qui un PDF scansionato, o clicca per sceglierlo
Fino a 100 MB · non viene caricato niente
- 100% nel tuo browser
- Nessun caricamento
- Download senza registrazione
- Nessun limite di pagine
Perché un PDF scansionato ha bisogno dell'OCR
Un PDF scansionato è una pila di fotografie. I tuoi occhi lo leggono senza problemi, ma per il computer su quelle pagine ci sono soltanto punti colorati. Ctrl+F non trova niente. Non puoi copiarne una riga. Nulla lo indicizza, quindi più avanti non ricomparirà in nessuna ricerca.
L'OCR — riconoscimento ottico dei caratteri — è il passaggio che cambia le cose. Guarda le forme su ogni pagina, decide di quali lettere si tratta e scrive quelle lettere dentro il file come livello invisibile sotto l'immagine. Dopo l'OCR il PDF ha esattamente lo stesso aspetto; la differenza è che ora sotto c'è del testo.
Il momento che conta arriva di solito mesi dopo. Un contratto che hai scansionato, una fattura, una ricevuta, la pagina di un libro: ti ricordi una frase e nient'altro. Un PDF ricercabile ti restituisce quella frase. Una pila di fotografie no.
Questo strumento di OCR per PDF funziona interamente nel tuo browser. Il file non viene caricato, non c'è nessun account e non c'è alcun tetto al numero di pagine. La pagina che ci precede su questa chiave elabora il tuo file gratis e poi ti chiede di registrarti prima di restituirtelo.
Che cos'è l'OCR su un PDF?
L'OCR su un PDF è il riconoscimento dei caratteri applicato alle immagini di pagina che contiene, con le parole riconosciute riscritte nello stesso file come livello di testo invisibile: il documento resta identico all'occhio, ma diventa ricercabile, selezionabile e copiabile.
Due tipi di PDF sono identici sullo schermo. Uno è stato esportato da un programma di scrittura e porta testo vero; l'altro viene da uno scanner o dalla fotocamera di un telefono e porta immagini di testo. Solo il secondo ha bisogno dell'OCR.
C'è un modo rapido per distinguerli senza alcuno strumento: prova a selezionare una riga con il mouse. Se un'evidenziazione azzurra segue le parole, il testo c'è già. Se si evidenzia l'intera pagina come un blocco, o non succede niente, hai un PDF scansionato.
Questo strumento fa quel controllo al posto tuo prima di eseguire qualsiasi cosa. Se il file ha già un livello di testo, te lo dice e suggerisce di estrarre il testo, perché l'OCR sostituirebbe qualcosa di esatto con qualcosa di approssimativo — e dopo non avresti modo di accorgertene, visto che la pagina resta identica in ogni caso.
Il testo prodotto dall'OCR va sotto l'immagine della pagina, non sopra. Per questo un PDF ricercabile sembra ancora una scansione: stai sempre guardando l'immagine originale. Il livello invisibile esiste solo per il tuo campo di ricerca, per il comando copia e per qualunque cosa indicizzi il file.
Vale la pena dire chiaramente che cos'è quel livello. È un'ipotesi: ottima su stampa pulita, pessima su una ricevuta spiegazzata fotografata storta. L'immagine che vedi è sempre giusta. Il testo sotto può non esserlo.
Come fare l'OCR di un PDF in quattro passi
Tutto avviene in questa scheda del browser. Il file non lascia il tuo dispositivo e nessuno ti chiederà un account prima di lasciarti scaricare il risultato.
Trascina il tuo PDF scansionato
Trascina il file sul riquadro qui sopra, oppure cliccaci per sfogliare. I file fino a 100 MB vanno bene. Non viene mandato niente da nessuna parte: il file lo apre questa pagina, nel tuo browser.
Leggi il verdetto
Lo strumento controlla ogni pagina alla ricerca di un livello di testo prima di fare qualsiasi cosa. Ti dirà se il tuo PDF ha bisogno dell'OCR, se ne ha bisogno solo su alcune pagine, o se non ne ha bisogno affatto. Se solo alcune pagine sono scansioni, le altre restano intatte per impostazione predefinita.
Scegli la lingua del documento
La precisione dipende da questo più che da qualsiasi altra cosa tu possa impostare. Scegli la lingua in cui è scritto il documento, non la lingua di questa interfaccia. I dati linguistici vengono scaricati una volta sola — circa 5,2 MB per l'inglese, 1,7 MB per l'hindi — e poi restano in cache. Selezionare più lingue funziona, ma rallenta ogni pagina.
Avvia e controlla il risultato
Le pagine vengono elaborate una alla volta, con un'anteprima di quella in lettura, così puoi fermarti subito se hai trascinato il file sbagliato. Alla fine prova a selezionare del testo nell'anteprima. Poi scarica il PDF ricercabile — o il testo semplice, se è tutto ciò che volevi.
Ti servono solo le parole? Se vuoi il testo e non il PDF, e il tuo file ha già un livello di testo, c'è una strada più rapida in cui non si indovina niente: estrarre il testo direttamente dal PDF.
Che cosa fa questo strumento di OCR per PDF
Aggiunge un livello di testo e non cambia nient'altro. Le tue pagine originali restano esattamente come sono: stesse immagini, stessa risoluzione, stessi riquadri di pagina. Le parole riconosciute vengono disegnate sopra con opacità zero, quindi si possono selezionare e cercare ma non si vedono mai. Le pagine che avevano già del testo non vengono riscritte affatto.
Renderizza le pagine a 150 DPI, ed è una scelta misurata, non un valore predefinito. Su un documento di prova, la precisione a 100, 150, 200 e 300 DPI è risultata uguale entro mezzo punto percentuale, mentre 300 DPI impiegava quattro volte tanto. Sotto i 100 DPI c'è un dirupo: a 72 DPI la precisione è scesa dal 95,6% al 79,3%. Scansionare a 600 DPI non renderà l'OCR più preciso. Lo renderà solo più lento.
Gestisce oltre 100 lingue, comprese scritture che la maggior parte dei convertitori salta. Uno degli strumenti di OCR online più noti elenca 19 lingue e nessuna di queste è una scrittura dell'Asia meridionale. Qui hindi, tamil e bengalese sono in elenco, e in alto, perché è lì che si trova davvero la maggior parte di chi cerca questo strumento.
Conta ciò che non è riuscito a fare. Se una pagina torna senza testo — un foglio bianco, una fotografia, della scrittura a mano — resta intatta nel file e viene segnalata. Niente sparisce in silenzio.
Non ti chiede mai di registrarti. Puoi elaborare un documento di 400 pagine e poi un altro. Non c'è un limite giornaliero, perché nessun server fa il lavoro e quindi non c'è niente da razionare.
A cosa serve l'OCR sui PDF:
- Rendere ricercabili contratti scansionati prima di archiviarli
- Trovare una riga in un capitolo fotografato pagina per pagina
- Trasformare una cartella di fatture scansionate in qualcosa di setacciabile
- Recuperare il testo da un fax o da una fotocopia arrivata in PDF
- Rendere vecchi documenti scansionati trovabili con la ricerca e non con la memoria
- Preparare scansioni perché un indice di ricerca o un altro programma possa leggerle
- Copiare un paragrafo da una scansione invece di riscriverlo a mano
Funziona su qualsiasi dispositivo
Non c'è niente da installare. L'OCR gira nel browser che hai già, quindi lo stesso strumento funziona ovunque e il tuo file resta sul dispositivo da cui è partito.
Windows
Chrome, Edge o Firefox. Niente da scaricare e nessun abbonamento Acrobat per rendere ricercabile una scansione.
Mac
Safari o Chrome. Anteprima sa mostrarti un PDF scansionato, ma non sa aggiungergli un livello di testo.
iPhone e iPad
Funziona in Safari. Comodo quando la scansione è una foto appena scattata, anche se è proprio il caso in cui raddrizzare la pagina conta di più.
Android
Funziona in Chrome. I documenti lunghi richiedono tempo e tengono occupato il telefono, quindi mettilo in carica prima.
Chromebook
Si adatta bene, perché tutto gira localmente nel browser invece di richiedere un'applicazione installata.
Linux
Qualsiasi browser moderno. Niente pacchetti, niente riga di comando, nessuna coda.
Che cosa l'OCR azzecca e che cosa sbaglia
Ogni strumento di OCR commette errori, e quasi nessuno ti dice che aspetto hanno quegli errori. Ecco un risultato reale: una fattura pulita, generata al computer, senza rumore, non storta, con il 95,6% di precisione per carattere in totale. Di dodici parole prese da lì, cinque si riuscivano a trovare cercandole.
| Nel documento | L'OCR ha letto | Perché |
|---|---|---|
| Northwind | Northwind | Prosa normale in un carattere proporzionale è il caso facile. |
| 2089.80 | 2089. 80 | È comparso uno spazio dentro il numero, quindi cercare il totale non dà nulla. |
| INV-2026-04471 | INV2026-04471 | È caduto un trattino. I numeri di riferimento sono particolarmente fragili. |
| Replacement | Repl acenent | Una m letta come n, più uno spazio che lì non c'è. |
| Payment is | Paymentis | L'errore opposto: uno spazio vero è stato eliminato. |
| 1741.50 | 1741.50 | Stessa tabella, stesso carattere del totale qui sopra — e questo è andato bene. Gli errori non sono prevedibili. |
Ciò che rovina davvero una scansione
Non è la compressione e non è la risoluzione. Un JPEG a qualità 60 è rimasto a una frazione di punto da un rendering senza perdite. A fare danni è stata l'inclinazione: una pagina storta di due gradi non ha creato problemi, ma a sette gradi la precisione è calata di nove punti e mezzo e la confidenza è scesa da 91 a 74. Se stai scansionando qualcosa, mettilo dritto. Non serve alzare i DPI.
PDF ricercabile, testo semplice o un file Word?
Un PDF ricercabile è ciò che produce questa pagina: la scansione che avevi, più un livello di testo invisibile, e resta un PDF. Il testo semplice sono le parole senza l'impaginazione — utile quando vuoi incollarle altrove, ed è offerto qui come secondo download. Un documento Word modificabile è un altro lavoro, che comporta ricostruire l'impaginazione, e questo strumento non lo fa. Se il tuo PDF ha già del testo e vuoi solo le parole, salta l'OCR ed estraile direttamente.
La tua scansione non lascia questo browser
Il PDF che trascini qui viene aperto da questa pagina, letto dal tuo processore e riscritto dal tuo browser. Non viene caricato, non viene messo in coda su un server e non resta da nessuna parte per un periodo di conservazione, perché nel lavoro non è coinvolto alcun server.
Questo pesa più nell'OCR che nella maggior parte delle conversioni. I documenti che la gente ha bisogno di rendere ricercabili sono contratti, cartelle cliniche, estratti conto e documenti d'identità: esattamente le scansioni che esistono perché valeva la pena conservare l'originale. Ogni grande servizio di OCR online li elabora sulle proprie macchine e li cancella secondo un calendario, di solito dopo una o otto ore.
Significa anche che non c'è niente da razionare. I servizi che fanno il lavoro sul proprio hardware devono limitare l'uso gratuito, ed è per questo che ti fermano a un paio di operazioni al giorno o a dieci pagine per file. Qui il lavoro avviene sul tuo dispositivo, quindi non c'è alcun limite da far rispettare né alcuna registrazione da raccogliere.
Non viene caricato niente
Il file viene letto localmente. Su nessun server ne viene creata una copia.
Mai un account
Non ti viene chiesto di registrarti per scaricare il risultato, che altrove è il prezzo abituale dell'OCR gratuito.
Nessun limite di pagine o di file
Elabora una scansione di 400 pagine, poi un'altra. Non c'è alcuna quota giornaliera.
Solo dati linguistici
L'unica cosa scaricata sono i dati di riconoscimento della lingua che scegli. Il tuo documento non fa mai parte di quella richiesta.
Domande frequenti
Questo strumento di OCR per PDF è davvero gratis e c'è un limite di pagine?⌄
Devo registrarmi per scaricare il risultato?⌄
Come faccio a sapere se il mio PDF ha davvero bisogno dell'OCR?⌄
Quanto è preciso l'OCR?⌄
Quali lingue sono supportate?⌄
Legge la scrittura a mano?⌄
Il PDF avrà un aspetto diverso dopo?⌄
Una scansione a DPI più alti dà risultati OCR migliori?⌄
Quanto ci mette?⌄
Il mio file viene caricato da qualche parte?⌄
Qual è la differenza rispetto a «PDF in testo»?⌄
Posso ottenere invece un documento Word modificabile?⌄
Rendi ricercabile il tuo PDF scansionato
Gratis, illimitato e gira in questa scheda. Nessun caricamento, nessuna registrazione — e ti avvisa se il tuo file non ha bisogno dell'OCR.
Fai l'OCR di un PDFStrumenti di conversione correlati
Scopri gli altri strumenti della nostra suite completa per la conversione dei file
PDF in testo
Estrai il testo, copialo o salvalo in .txt. Ricostruisce l'ordine di lettura, recupera i campi modulo compilati e ti dice quando una pagina è una scansione.
PDF scansionato in PNG
PNG privato e senza perdita di qualità da documenti scansionati
Comprimi PDF
Riduci le dimensioni di un PDF fino all'80%