Come estrarre il testo da un PDF scansionato

Un PDF scansionato è una pila di immagini di pagine, quindi non c'è testo da selezionare o copiare. Per tirare fuori le parole serve l'OCR. Lo strumento gratuito PDF in testo fa entrambe le cose nel browser: legge direttamente il livello di testo delle pagine digitali e applica l'OCR solo alle pagine che sono immagini.

Perché non riesco a copiare il testo da un PDF?

Di solito perché la pagina è una scansione o una foto salvata come PDF. Il file mostra lettere, ma sotto ci sono solo pixel. Alcuni PDF hanno anche la copia disattivata dall'autore. Se non riesci a evidenziare una singola parola, la pagina ha bisogno dell'OCR prima di poter copiare il testo.

Come capire se un PDF è scansionato?

Aprilo e prova a selezionare una frase. Se le parole si evidenziano una a una, la pagina ha un livello di testo. Se tutta la pagina si seleziona come un'immagine, o non si seleziona nulla, è una scansione. Molti PDF mescolano le due cose: pagine digitate con qualche allegato scansionato in fondo.

Come fare l'OCR di un PDF gratis?

  1. Apri lo strumentoVai su PDF in testo.
  2. Aggiungi il PDFScegli un file fino a 50 MB.
  3. Scegli la lingua OCRSeleziona la lingua del documento perché le pagine scansionate vengano lette bene.
  4. EstraiLe pagine con testo escono subito; quelle scansionate vengono riconosciute una alla volta.
  5. Copia o scaricaCopia il risultato o salvalo come file di testo.

Come ripulire il testo estratto?

Le scansioni spesso spezzano le frasi a ogni fine riga stampata e dividono le parole con il trattino. Se lavori il testo con il codice, poche righe di JavaScript ricompongono i paragrafi. Incolla il risultato dell'OCR nella variabile text ed eseguilo nella console del browser o in Node.js.

join-ocr-lines.js
const text = `incolla qui il risultato dell'OCR`;

const cleaned = text
  .replace(/-\n(?=\p{Ll})/gu, '')   // riunisce le parole spezzate
  .replace(/(?<!\n)\n(?!\n)/g, ' ') // a capo singoli -> spazi
  .replace(/[ \t]{2,}/g, ' ');      // spazi ripetuti -> uno

console.log(cleaned);

È sicuro con documenti riservati?

Sì. Il PDF viene elaborato dal tuo browser e non viene mai caricato su un server, quindi va bene per contratti, fatture e referti. Una scansione migliore dà un testo migliore: leggi cosa influisce davvero sulla precisione dell'OCR prima di riscansionare.

E se ho solo foto delle pagine?

Allora salta il PDF e usa direttamente gli strumenti per immagini: copiare il testo da un'immagine per una pagina, oppure l'OCR multi immagine per un massimo di 20 pagine in una volta.

Estrai il testo dal tuo PDF

Prima il livello di testo, OCR per le scansioni. Tutto nel browser.

Articoli correlati

October 4, 2026
Guida
Arbab Naseer

Come leggere numeri di telefono ed email da un'immagine

Estrai numeri di telefono e indirizzi email da foto, volantini o screenshot con l'OCR gratuito nel browser e copiali senza riscrivere nemmeno una cifra.

October 4, 2026
Guida
Arbab Naseer

Come copiare il testo da un'immagine su iPhone, Android, Windows e Mac

Copia il testo da un'immagine su iPhone, Android, Windows o Mac con gli strumenti integrati o con un OCR gratuito nel browser, uguale su ogni dispositivo.

October 3, 2026
Guida
Arbab Naseer

Come estrarre il testo da uno screenshot

Trasforma uno screenshot in testo modificabile: incollalo in un OCR gratuito nel browser e copia il risultato. Scorciatoie per Windows, Mac e smartphone.

Torna al blog

We are also available in other languages

Ad Sponsored Check this offer
Ad Sponsored Check this offer