OCR: estrarre il testo da un PDF scansionato
Riconoscimento ottico dei caratteri al 100% nel tuo browser (tesseract). Estrae il testo dalle scansioni e, se vuoi, genera un PDF ricercabile.
I tuoi file non lasciano il tuo dispositivo
Come fare l'OCR su un PDF
- 1
Carica il PDF scansionato
E scegli la lingua del documento.
- 2
Riconoscimento
Ogni pagina viene elaborata nel tuo browser con tesseract.
- 3
Copia o scarica
Il testo in .txt e, se vuoi, un PDF ricercabile.
Perché usare questo strumento
100% locale
L'OCR gira nel tuo browser: le scansioni non vengono caricate.
Spagnolo e inglese
Modelli addestrati per entrambe le lingue, anche combinate.
PDF ricercabile
Strato di testo invisibile opzionale sopra la scansione originale.
Progresso reale
Vedi l'avanzamento pagina per pagina, senza barre inventate.
Domande frequenti
Che precisione ha l'OCR?
Con scansioni nitide (300 dpi, testo stampato) la precisione è alta. Manoscritti, foto storte o bassa risoluzione la riducono. Il motore è tesseract, l'OCR libero di riferimento.
Perché la prima volta ci mette di più?
Si scaricano il motore WASM e il modello della lingua (circa 15 MB) da questo stesso sito. Restano in cache per le volte successive.
Cos'è il PDF ricercabile?
La tua scansione originale intatta più uno strato di testo invisibile allineato a ogni parola: potrai cercare con Ctrl+F e selezionare testo. L'allineamento è approssimato.
Il mio documento viene caricato su qualche server?
No. Tutto il riconoscimento avviene sul tuo dispositivo; né il PDF né il testo lasciano il tuo browser.