FeelTheFile

OCR: estrarre il testo da un PDF scansionato

Riconoscimento ottico dei caratteri al 100% nel tuo browser (tesseract). Estrae il testo dalle scansioni e, se vuoi, genera un PDF ricercabile.

I tuoi file non lasciano il tuo dispositivo

Come fare l'OCR su un PDF

  1. 1

    Carica il PDF scansionato

    E scegli la lingua del documento.

  2. 2

    Riconoscimento

    Ogni pagina viene elaborata nel tuo browser con tesseract.

  3. 3

    Copia o scarica

    Il testo in .txt e, se vuoi, un PDF ricercabile.

Perché usare questo strumento

  • 100% locale

    L'OCR gira nel tuo browser: le scansioni non vengono caricate.

  • Spagnolo e inglese

    Modelli addestrati per entrambe le lingue, anche combinate.

  • PDF ricercabile

    Strato di testo invisibile opzionale sopra la scansione originale.

  • Progresso reale

    Vedi l'avanzamento pagina per pagina, senza barre inventate.

Domande frequenti

Che precisione ha l'OCR?

Con scansioni nitide (300 dpi, testo stampato) la precisione è alta. Manoscritti, foto storte o bassa risoluzione la riducono. Il motore è tesseract, l'OCR libero di riferimento.

Perché la prima volta ci mette di più?

Si scaricano il motore WASM e il modello della lingua (circa 15 MB) da questo stesso sito. Restano in cache per le volte successive.

Cos'è il PDF ricercabile?

La tua scansione originale intatta più uno strato di testo invisibile allineato a ogni parola: potrai cercare con Ctrl+F e selezionare testo. L'allineamento è approssimato.

Il mio documento viene caricato su qualche server?

No. Tutto il riconoscimento avviene sul tuo dispositivo; né il PDF né il testo lasciano il tuo browser.

Strumenti correlati