OCR PDF

Leggi il testo di un PDF scansionato — copialo o salvalo come file .txt.

100% privato — funziona interamente nel tuo browser. I tuoi dati vengono elaborati sul tuo dispositivo e non vengono mai inviati a Internet.

Clicca per caricare o trascina qui un PDF scansionato

Un PDF — letto con l'OCR sul tuo dispositivo, mai caricato

L'OCR per i PDF

Alcuni PDF non contengono nessun testo. Un contratto scansionato, uno scontrino fotografato, un fax, un vecchio libro passato allo scanner di una biblioteca — ogni pagina è solo un'immagine di testo. Puoi leggerla, ma non puoi selezionarla, copiarla né cercarci dentro.

L'OCR (riconoscimento ottico dei caratteri) risolve il problema. Guarda l'immagine di ogni pagina, riconosce la forma delle lettere e ti restituisce testo vero che puoi copiare, modificare e cercare.

Questo strumento lavora pagina per pagina e mostra il testo appena una pagina è pronta, così non devi aspettare tutto il documento prima di cominciare.

Tutto avviene sul tuo dispositivo

I PDF scansionati sono spesso quelli privati: un documento d'identità, una lettera della banca, un modulo medico, un contratto firmato. La maggior parte dei servizi OCR online ti chiede di caricarli.

Questo no. Il motore OCR (Tesseract, il motore open source usato da molti programmi professionali) funziona dentro il tuo browser:

  • Privato — il PDF non lascia mai il tuo dispositivo
  • Nessuna registrazione, nessun limite di pagine, nessuna filigrana

Alla prima esecuzione vengono scaricati il motore e i dati della lingua — pochi megabyte. Il browser li conserva, quindi la volta dopo parte più in fretta.

Pagine di testo e pagine scansionate nello stesso file

Molti PDF sono misti. Pagine scritte al computer con una pagina della firma scansionata in fondo. Una scansione su cui qualcuno ha già fatto l'OCR. Un report con qualche pagina fotografata nel mezzo.

Per impostazione predefinita, lo strumento controlla prima ogni pagina:

  • Una pagina che ha già testo vero viene copiata così com'è — esatta, istantanea, senza errori di OCR
  • Una pagina che è solo un'immagine viene letta con l'OCR

Alla fine vedi quante pagine sono passate da una parte e quante dall'altra. Togli la spunta a "Pagine che hanno già testo vero" per forzare l'OCR su tutte le pagine — utile quando il vecchio livello di testo è sbagliato o illeggibile.

Ottenere il risultato migliore

L'OCR è molto bravo, ma legge un'immagine, quindi l'immagine conta:

  • Scegli la lingua giusta. Cambia le lettere e gli accenti che il motore si aspetta. Un testo italiano letto come inglese perde le sue à, è e ù.
  • Le pagine dritte e nitide si leggono meglio. Una foto storta col telefono o un fax sfocato danno più errori.
  • Il normale testo stampato si legge bene. La scrittura a mano, i caratteri molto piccoli e i font decorativi si leggono male.
  • Le tabelle escono come righe di testo, non come tabella. Per una tabella, controlla le colonne dopo.
  • Leggi sempre il risultato prima di fidarti. Attenzione a 1 / l / I, 0 / O e rn / m — le classiche confusioni dell'OCR.

A cosa serve

  • Copiare un paragrafo da un contratto scansionato o da una lettera
  • Ottenere il testo di un vecchio libro o articolo che esiste solo come scansione
  • Rendere cercabile nelle tue note la scansione di uno scontrino o una fattura
  • Estrarre citazioni da articoli scientifici scansionati e dispense
  • Trascrivere moduli e documenti senza riscriverli a mano
  • Trasformare un documento arrivato via fax in qualcosa da modificare

Buono a sapersi

  • Un PDF protetto da password va prima sbloccato — usa Sblocca PDF
  • I documenti grandi richiedono tempo: circa 2–10 secondi per pagina su un computer, di più su un telefono. Usa Pagine per leggere solo la parte che ti serve
  • Ferma conserva tutte le pagine già lette
  • Il risultato è testo semplice. Per portarlo in Word, incollalo, oppure usa Da PDF a Word per i PDF che hanno già testo
  • Se il tuo PDF ha testo vero in ogni pagina, Da PDF a testo è più veloce e ha più opzioni di impaginazione

Domande frequenti

È gratis?

Sì. Nessuna registrazione, nessun limite di pagine, nessuna filigrana.

Il mio PDF viene caricato?

No. Le pagine vengono disegnate e lette dentro questa pagina, sul tuo dispositivo.

Quali lingue legge?

Inglese, spagnolo, francese, tedesco, italiano, portoghese, olandese, cinese (semplificato), giapponese e coreano. Scegline una prima di iniziare.

Perché ci sono errori nel testo?

L'OCR indovina ogni lettera dalla sua forma. Una scansione sfocata, storta o a bassa risoluzione lo fa sbagliare più spesso. Controlla il risultato e correggi i pochi errori nel riquadro prima di copiarlo.

Può rendere il mio PDF ricercabile?

Non ancora — ti dà il testo in un file .txt separato. Il tuo PDF originale non viene modificato.

Come si usa

  • Clicca su Clicca per caricare, o trascina il PDF scansionato nel riquadro
  • Scegli la lingua del testo
  • Scrivi un intervallo di pagine se te ne servono solo alcune — o lascia vuoto per tutte
  • Clicca su Leggi il testo e guarda arrivare le pagine
  • Controlla il testo, poi clicca su Copia o Scarica il .txt

Strumenti correlati

Aggiungiamo regolarmente nuovi strumenti — iscriviti su YouTube per ricevere una notifica a ogni novità.

Altri strumenti

Vedi tutti

App consigliate

Vedi tutti