OCR PDF
Trasforma un PDF scansionato in uno ricercabile e selezionabile. L’OCR gira in locale nel tuo browser, quindi il file non lascia mai il dispositivo.
Non si carica nulla
Il motore OCR per PDF gira come WebAssembly dentro il tuo browser. La scansione non viene mai inviata a un server.
Guarda cosa ha letto
Ogni parola riconosciuta viene evidenziata sulla pagina, così controlli il risultato prima di scaricare.
11 lingue
Sono supportati alfabeto latino, cirillico e scritture CJK, cinese, giapponese, coreano e russo compresi.
Gratis, senza registrazione
Nessun account, nessuna filigrana, nessun limite di pagine. L’unico limite reale è la memoria del tuo dispositivo.
In breve: L’OCR PDF legge il testo da una pagina scansionata e lo riscrive nel PDF come livello di testo invisibile. La pagina resta identica, ma finalmente puoi cercarla, selezionarla e copiarla. Questo strumento fa tutto il lavoro dentro il tuo browser.
Perché i PDF scansionati bloccano il tuo lavoro
Un cliente ti rimanda un contratto. Devi trovare una clausola. Premi Ctrl+F, digiti la parola e il PDF ti dice che non ci sono risultati, anche se la parola è lì davanti a te.
È il momento in cui la maggior parte delle persone inizia a cercare un OCR per PDF. Il documento non è rotto: semplicemente non ha mai contenuto testo.
Una scansione è un’immagine, non un documento
Quando uno scanner o la fotocamera di un telefono acquisisce una pagina, registra pixel. Le lettere che vedi sono forme, non caratteri. Per il lettore PDF l’intera pagina è una sola immagine piatta.
Cosa perdi senza riconoscimento del testo
Niente ricerca. Niente copia e incolla. Niente selezione per citare. Gli screen reader non annunciano nulla. Il tuo gestionale documentale indicizza un file vuoto. Tutte queste funzioni dipendono dal fatto che la pagina contenga caratteri veri.
Dove pesa di più
Contratti firmati, fatture cartacee, ricevute, cartelle cliniche, articoli accademici, vecchi archivi. Sono esattamente i documenti che dovrai cercare più avanti, ed esattamente quelli che arrivano scansionati.
Che cos’è l’OCR PDF?
L’OCR PDF è il processo che legge il testo dall’immagine di una pagina scansionata e lo salva di nuovo nel PDF come livello di testo reale ma invisibile: la pagina resta identica, ma ora puoi cercare, selezionare e copiare le parole che contiene.
OCR sta per riconoscimento ottico dei caratteri. Il motore osserva le forme sulla pagina, le confronta con le lettere di una lingua e restituisce i caratteri insieme alla posizione esatta di ogni parola.
Come funziona il livello di testo invisibile
Le parole riconosciute vengono ridisegnate sulla pagina nella modalità di resa del testo 3 del PDF, che significa «disegna questo testo ma non mostrarlo». Ogni parola si posiziona esattamente sopra la sua immagine nella scansione.
Per questo un file trattato bene con l’OCR sembra del tutto immutato e, ciò nonostante, si evidenzia correttamente quando lo cerchi. Stai selezionando il livello invisibile, non l’immagine.
PDF ricercabile o estrazione di testo semplice
Quando vuoi un PDF ricercabile
Devi mantenere l’aspetto originale: firme, timbri, carta intestata, impaginazione. Tutto ciò che deve restare presentabile o giuridicamente riconoscibile deve restare un PDF.
Quando ti basta il testo
Devi incollare in un’email, un foglio di calcolo o un appunto. Allora lascia perdere il PDF e prendi l’esportazione in testo semplice. Questo strumento ti dà entrambe le cose in un solo passaggio.
Cosa l’OCR non può sistemare
L’OCR legge quello che c’è. Non recupera il testo che la scansione ha sfocato e non fa da correttore di bozze. Una foto storta e a bassa risoluzione produrrà risultati storti e di bassa qualità.
Come fare l’OCR di un PDF in 3 passaggi
L’intero processo avviene sulla tua macchina. Nessuna coda, nessun caricamento e nessuna sala d’attesa.
- 1
Apri il PDF scansionato
Trascina il file nel riquadro qui sopra, oppure selezionalo dal dispositivo. Si carica direttamente nella scheda del browser: il passaggio di upload non esiste proprio.
- 2
Scegli la lingua del documento
Scegli la lingua stampata sulla pagina, non quella dell’interfaccia. Il motore scarica quel pacchetto lingua una volta e lo tiene in cache.
- 3
Avvia l’OCR e scarica
Seguilo pagina per pagina, controlla le parole evidenziate e poi prendi il PDF ricercabile o il testo semplice. Entrambi sono generati in locale.
Consiglio — La scelta della lingua conta più di quanto si creda. Far passare l’inglese su una pagina in tedesco rovinerà ogni dieresi. Se il risultato sembra incomprensibile, di solito la causa è la lingua.
Nota — Il primo passaggio con una lingua nuova scarica un pacchetto di meno di 3 MB. Dopo è immediato e funziona anche offline.
Guarda cosa ha letto davvero l’OCR
La maggior parte degli strumenti di OCR per PDF ti consegna un file e ti augura buona fortuna. Scopri se ha funzionato solo dopo averlo scaricato, aperto e cercato da solo.
È un pessimo affare, perché la qualità delle scansioni varia moltissimo e l’OCR PDF fallisce in silenzio. Uno strumento che restituisce il 60 % di accuratezza sembra identico a uno che ne restituisce il 99 %.
Il livello di testo, reso visibile
Attiva «Mostra livello di testo» e ogni parola riconosciuta viene racchiusa in un riquadro sulla pagina. Quello che vedi è esattamente ciò che è stato scritto nel PDF.
Come riconoscere una brutta scansione prima di scaricare
Le parole di cui il motore non è sicuro sono marcate in rosso. Passa il mouse su un riquadro per vedere cosa ha letto e con quanta sicurezza.
Qualche riquadro rosso sparso è normale. Una pagina quasi tutta rossa significa che qualcosa non va: di solito la lingua sbagliata, oppure una scansione da rifare a risoluzione più alta.
Cosa puoi fare con un PDF ricercabile
Una volta che il livello di testo esiste, il documento inizia a comportarsi come un documento vero ovunque tu lo usi.
Cercare dentro il documento
Ctrl+F funziona in qualsiasi lettore PDF, su qualsiasi dispositivo. Trovare una clausola in un contratto scansionato di 60 pagine smette di essere uno scorrimento manuale.
Copiare e citare senza ribattere
Seleziona un paragrafo e incollalo in un’email o in una relazione. Nessuna trascrizione e nessun refuso introdotto per strada.
Rendere accessibili le scansioni
Gli screen reader possono leggere solo un livello di testo. Eseguire l’OCR è spesso il singolo miglioramento di accessibilità più grande che puoi fare a un archivio di scansioni.
Passare testo pulito ad altri strumenti
Indici di ricerca, app per appunti, traduttori e fogli di calcolo hanno bisogno di caratteri, non di pixel. L’esportazione in testo semplice ci entra direttamente.
La tua scansione non lascia questa scheda
I documenti scansionati sono di solito i file più delicati che una persona possiede: accordi firmati, passaporti, pratiche fiscali, referti medici. Caricarli su un server sconosciuto solo per renderli ricercabili è uno scambio bizzarro.
Questo strumento carica il motore OCR nel tuo browser come WebAssembly e lo esegue lì. I pacchetti lingua arrivano dal nostro server, ma il tuo documento non va da nessuna parte. Puoi scollegarti dalla rete dopo il caricamento della pagina e il lavoro verrà comunque portato a termine.
OCR PDF nel browser rispetto agli strumenti con caricamento
L’elaborazione locale è la scelta predefinita giusta per i documenti riservati, ma non è priva di compromessi. Ecco il confronto onesto.
| Aspetto | Questo strumento (nel browser) | Strumenti OCR con caricamento |
|---|---|---|
| Dove finisce il file | Non lascia mai il tuo dispositivo | Viene caricato su un server remoto |
| Funziona offline | Sì, dopo il primo caricamento | No |
| Limite di dimensione | Dettato dalla memoria del dispositivo | Dettato dal piano del servizio |
| Serve un account | No | Spesso, per i file più grandi |
| Velocità su PDF enormi | Più lenta: usa la tua CPU | Più rapida: usa i loro server |
| Accuratezza su scansioni difficili | Buona con stampa pulita | Spesso migliore: motori commerciali |
Le ultime due righe sono vere. Un servizio commerciale con un motore ottimizzato batterà uno open source davanti a un fax spiegazzato del 1998, e una server farm sarà sempre più veloce di un portatile su un file da 500 pagine. Se il tuo documento non è delicato e l’accuratezza su una brutta scansione conta più della riservatezza, usa uno di quelli.
Come ottenere la migliore accuratezza OCR
La qualità dell’OCR PDF si decide soprattutto prima di premere il pulsante. Questi quattro punti spiegano quasi tutta la differenza.
- 1
Scansiona a 300 DPI o più
È il fattore singolo più importante. A 150 DPI i bordi dei caratteri iniziano a fondersi; a 72 DPI la maggior parte dei motori tira a indovinare. 300 DPI è l’obiettivo standard per il riconoscimento del testo.
- 2
Raddrizza e pulisci prima la pagina
Una pagina ruotata anche solo di due gradi abbassa l’accuratezza in modo misurabile. Attiva il raddrizzamento per le scansioni storte e la rimozione dello sfondo per quelle grigie o puntinate.
- 3
Una lingua per passaggio
Mescolare i pacchetti lingua diluisce l’accuratezza. Se un documento è soprattutto in inglese con qualche nome francese, elaboralo come inglese.
- 4
Controlla il livello di testo e ripeti
Guarda le parole evidenziate prima di scaricare. Se una pagina è piena di riquadri rossi, cambia lingua o impostazioni di scansione e riprova: non ti costa nulla.
Suite completa di strumenti PDF
Scopri la nostra raccolta completa di strumenti PDF, pensati per ogni tua esigenza documentale
PNG in PDF
Raccogli immagini PNG in un unico PDF pronto per la stampa
JPG in PDF
Converti immagini JPG in formato PDF
Unire PDF
Combina più file PDF in uno solo
Comprimere PDF
Riduci le dimensioni del PDF in modo efficiente
PDF in PNG
Converti le pagine di un PDF in immagini PNG
PDF in JPG
Converti le pagine di un PDF in immagini JPG
PDF in testo
Estrai il contenuto testuale dai file PDF
Dividere PDF
Dividi un PDF in pagine separate
Modificare PDF
Modifica e annota documenti PDF
Organizzare PDF
Organizza e riordina le pagine di un PDF
Ruota PDF
Ruota le pagine di un PDF e salva in modo permanente
Numeri di pagina
Aggiungi numeri di pagina al PDF con anteprima in tempo reale
Filigrana PDF
Aggiungi una filigrana di testo al PDF con anteprima in tempo reale
HEIC in JPG
Converti le foto HEIC dell'iPhone in JPG
Elimina Pagine PDF
Rimuovi le pagine indesiderate e scarica un PDF pulito
Estrai Pagine PDF
Salva le pagine selezionate come nuovo PDF o come file separati
Firmare PDF
Disegna, digita o carica una firma e posizionala su qualsiasi pagina
Ridimensiona PDF
Cambia il formato pagina in A4, Letter o dimensioni personalizzate
Ritaglia PDF
Rifila i margini, seleziona trascinando o ritaglia automaticamente lo spazio bianco
Appiattisci PDF
Rendi i moduli a sola lettura — mantieni il testo ricercabile o blocca in immagine
Metadati PDF
Visualizza, modifica o elimina autore, titolo, date e altri metadati
PDF in scala di grigi
Converti in scala di grigi o bianco e nero per risparmiare inchiostro a colori
Estrai immagini da PDF
Estrai foto e grafiche incorporate in un PDF e salvale come PNG o JPG
WebP in PDF
Converti immagini WebP in un PDF, unendone tante in un unico file
Proteggi PDF
Aggiungi una password di apertura al tuo PDF, interamente nel browser
Sblocca PDF
Rimuovi da un PDF una password che conosci o le sue restrizioni, nel browser
HEIC in PDF
Converti le foto HEIC dell'iPhone in PDF
AVIF in PDF
Converti immagini AVIF in PDF
TIFF in PDF
Converti immagini e scansioni TIFF in PDF
BMP in PDF
Converti immagini BMP in PDF
OCR PDF
Rendi ricercabile un PDF scansionato, tutto nel tuo browser
Oscurare PDF
Rimuovi definitivamente il testo sensibile da un PDF, nel tuo browser
Comprimi immagine
Riduci JPEG, PNG e WebP in blocco, tutto nel tuo browser
Ridimensionare immagini
Cambia le dimensioni in blocco, con preset, nel tuo browser
Domande frequenti
Tutto quello che si chiede prima di eseguire l’OCR PDF su una scansione.
Come si fa l’OCR di un PDF gratis?
Apri il file qui sopra, scegli la lingua del documento e premi Avvia OCR. L’intero processo avviene in questa scheda del browser e non costa nulla. Ottieni un PDF ricercabile e un file di testo, senza account e senza limite di pagine.
Questo strumento di OCR PDF è davvero gratis? Qual è il limite?
È gratis, senza tetto di pagine e senza filigrana. Non imponiamo quote perché il costo non è nostro: il lavoro lo fa il tuo dispositivo. Il limite pratico è la memoria; su un telefono datato una scansione molto grande può esaurirla, e in quel caso conviene procedere per intervalli di pagine.
I miei file vengono caricati su un server?
No. Il tuo PDF non lascia mai il browser. Il motore OCR è WebAssembly eseguito in locale. Le uniche cose scaricate da noi sono il motore e il pacchetto lingua. Puoi verificarlo scollegandoti dalla rete dopo il caricamento della pagina: l’OCR continua a funzionare.
Quanto è accurato l’OCR PDF?
Molto buono su testo stampato pulito, più debole su scrittura a mano e scansioni scadenti. Una scansione a 300 DPI di normale testo stampato viene di solito riconosciuta oltre il novanta per cento. Scrittura a mano, carta da fax sbiadita, tabelle fitte e foto a bassa risoluzione peggiorano in fretta il risultato. Usa la vista del livello di testo per giudicare il tuo documento invece di fidarti di una media.
Posso convertire un PDF scansionato in Word con l’OCR?
Non direttamente: questo strumento produce un PDF ricercabile e testo semplice, non un .docx. Nella maggior parte dei casi l’esportazione in testo semplice è proprio ciò che serve e si incolla direttamente in un documento. Se vuoi solo il testo, il nostro strumento da PDF a testo copre quel caso.
Quali lingue supporta l’OCR PDF?
Undici, che coprono scritture latina, cirillica e CJK. Inglese, cinese semplificato e tradizionale, spagnolo, portoghese, tedesco, francese, italiano, giapponese, coreano e russo. Le scritture non latine ottengono un livello di testo completo, quindi le scansioni in cinese e in russo sono davvero ricercabili, non solo in parte.
Perché il primo passaggio è più lento del secondo?
Il primo scarica il motore OCR e il pacchetto lingua. Dopo restano entrambi nella cache del browser, quindi i passaggi successivi partono subito e funzionano senza connessione. Passare a una lingua nuova scarica quel pacchetto una volta.
Cosa faccio dopo aver eseguito l’OCR su un PDF?
Di solito comprimerlo, oppure estrarne il testo. Il livello di testo aggiunge solo pochi kilobyte per pagina, ma la scansione sottostante è spesso pesante. Comprimere dopo mantiene la ricercabilità e riduce la dimensione del file.
Strumenti correlati
Altre cose che potresti voler fare con lo stesso documento.
- PDF in testo — estrai il testo da un PDF che ha già un livello di testo.
- Comprimi PDF — alleggerisci la scansione dopo l’OCR senza perdere il livello di testo.
- PDF in PNG — esporta le pagine come immagini se vuoi ripulirle prima di riscansionare.
- PDF in scala di grigi — togli il colore a una scansione rumorosa: spesso aiuta il riconoscimento.
- Unisci PDF — unisci più pagine scansionate in un documento prima di avviare l’OCR.
- Oscurare PDF — rimuovi il testo sensibile una volta che la scansione è ricercabile.
Rendi ricercabili le tue scansioni
Esegui l’OCR su un PDF proprio qui, nel tuo browser. Senza caricamenti, senza account, senza limite di pagine.
Apri lo strumento OCR PDF