Cómo extraer el texto de una imagen
- Elige el idioma del texto: español, inglés o ambos si está mezclado.
- Arrastra una o varias imágenes (JPG, PNG, WebP) o un PDF escaneado.
- Pulsa Reconocer texto, espera a que termine la barra de progreso y copia o descarga el resultado.
Qué precisión esperar
El reconocimiento funciona muy bien con texto impreso, nítido y recto: capturas de pantalla, documentos escaneados a buena resolución, páginas de libros, facturas o carteles. La precisión baja con fotos movidas o desenfocadas, poca luz, texto inclinado, fondos con dibujos, letra manuscrita o tamaños muy pequeños. Para mejorar el resultado, usa imágenes de al menos 150 a 300 ppp, con buen contraste y la página recta. Revisa siempre el texto antes de usarlo: las tildes, los números y los símbolos son lo que más se escapa.
PDF escaneados
Si subes un PDF, cada página se convierte en imagen en tu navegador y se pasa por el reconocimiento. Los PDF largos tardan: cuenta unos segundos por página. Si el PDF ya tiene texto seleccionable, es más rápido y exacto usar PDF a texto.
Privado: tu imagen no sale de tu ordenador
El motor de OCR (Tesseract) se ejecuta en tu propio navegador. Ni tus imágenes ni el texto reconocido se envían a ningún servidor, así que puedes usarlo con DNI, facturas o contratos. Solo se descarga el motor y el idioma desde esta misma web, y únicamente cuando pulsas el botón.
Preguntas frecuentes
¿Qué idiomas reconoce?
Español e inglés, o los dos a la vez. Con el texto en español elige Español para que reconozca bien tildes, ñ, ¿ y ¡.
¿Reconoce letra manuscrita?
No de forma fiable. Está pensado para texto impreso o de ordenador.
¿Por qué tarda tanto la primera vez?
Porque descarga el motor de reconocimiento y los datos del idioma (varios megas). El navegador los guarda y las siguientes veces ya no hace falta descargar nada.
¿Se suben mis imágenes a internet?
No. Todo el proceso ocurre en tu navegador.
¿Mantiene el formato del documento?
Solo el texto y los saltos de línea y de párrafo. No conserva columnas, tablas, fuentes ni imágenes.