FeelTheFile

OCR: extraer texto de un PDF escaneado

Reconocimiento óptico de caracteres 100% en tu navegador (tesseract). Extrae el texto de escaneos y, si quieres, genera un PDF buscable.

Tus archivos no salen de tu dispositivo

Cómo hacer OCR a un PDF

  1. 1

    Sube el PDF escaneado

    Y elige el idioma del documento.

  2. 2

    Reconocimiento

    Cada página se procesa en tu navegador con tesseract.

  3. 3

    Copia o descarga

    El texto en .txt y, si quieres, un PDF buscable.

Por qué usar esta herramienta

  • 100% local

    El OCR corre en tu navegador: los escaneos no se suben.

  • Español e inglés

    Modelos entrenados para ambos idiomas, incluso combinados.

  • PDF buscable

    Capa de texto invisible opcional sobre el escaneo original.

  • Progreso real

    Ves el avance página a página, sin barras inventadas.

Preguntas frecuentes

¿Qué precisión tiene el OCR?

Con escaneos nítidos (300 ppp, texto impreso) la precisión es alta. Manuscritos, fotos torcidas o baja resolución la reducen. El motor es tesseract, el OCR libre de referencia.

¿Por qué la primera vez tarda más?

Se descargan el motor WASM y el modelo del idioma (unos 15 MB) desde este mismo sitio. Quedan cacheados para las siguientes veces.

¿Qué es el PDF buscable?

Tu escaneo original intacto más una capa de texto invisible alineada con cada palabra: podrás buscar con Ctrl+F y seleccionar texto. La alineación es aproximada.

¿Se sube mi documento a algún servidor?

No. Todo el reconocimiento ocurre en tu dispositivo; ni el PDF ni el texto salen de tu navegador.

Herramientas relacionadas