OCR: extraer texto de un PDF escaneado
Reconocimiento óptico de caracteres 100% en tu navegador (tesseract). Extrae el texto de escaneos y, si quieres, genera un PDF buscable.
Tus archivos no salen de tu dispositivo
Cómo hacer OCR a un PDF
- 1
Sube el PDF escaneado
Y elige el idioma del documento.
- 2
Reconocimiento
Cada página se procesa en tu navegador con tesseract.
- 3
Copia o descarga
El texto en .txt y, si quieres, un PDF buscable.
Por qué usar esta herramienta
100% local
El OCR corre en tu navegador: los escaneos no se suben.
Español e inglés
Modelos entrenados para ambos idiomas, incluso combinados.
PDF buscable
Capa de texto invisible opcional sobre el escaneo original.
Progreso real
Ves el avance página a página, sin barras inventadas.
Preguntas frecuentes
¿Qué precisión tiene el OCR?
Con escaneos nítidos (300 ppp, texto impreso) la precisión es alta. Manuscritos, fotos torcidas o baja resolución la reducen. El motor es tesseract, el OCR libre de referencia.
¿Por qué la primera vez tarda más?
Se descargan el motor WASM y el modelo del idioma (unos 15 MB) desde este mismo sitio. Quedan cacheados para las siguientes veces.
¿Qué es el PDF buscable?
Tu escaneo original intacto más una capa de texto invisible alineada con cada palabra: podrás buscar con Ctrl+F y seleccionar texto. La alineación es aproximada.
¿Se sube mi documento a algún servidor?
No. Todo el reconocimiento ocurre en tu dispositivo; ni el PDF ni el texto salen de tu navegador.