Imagen a texto

Extraer el texto de una imagen

Lee las palabras de una foto, una captura de pantalla o un escaneo, y obtén un texto que puedes seleccionar, corregir y pegar.

Extraer el texto de una imagen en línea

La foto de una página, la captura de un mensaje, el escaneo de un recibo: las palabras están ahí, pero no puedes seleccionarlas porque el archivo es una imagen. El reconocimiento óptico de caracteres analiza las formas y deduce qué letras son, para devolverte texto editable. Esta herramienta hace ese reconocimiento con Tesseract compilado a WebAssembly, íntegramente dentro de tu navegador: la imagen se abre en local y nunca se sube, algo importante con una nómina, un documento de identidad o un resultado médico. Hay dos ajustes de idioma: inglés con francés como secundario, y francés con inglés como secundario; el modelo correspondiente, de cinco a quince megabytes, se descarga la primera vez y después se reutiliza. La precisión depende de la imagen: un texto nítido, bien iluminado, fotografiado de frente y con una resolución razonable se lee bien, mientras que una foto borrosa, tomada en ángulo y con poca luz producirá errores que tendrás que corregir. Cuando encuentra poco o nada, la herramienta te lo dice en lugar de quedarse en silencio.

Cómo funciona

  1. Elige la imagen

    Una foto, una captura de pantalla o un escaneo. Se queda en tu dispositivo: el reconocimiento se ejecuta en tu navegador, no en nuestros servidores.

  2. Elige el idioma

    Inglés o francés como principal, el otro como secundario. La primera vez se descarga el modelo, de cinco a quince megabytes, y las siguientes lo reutilizan.

  3. Lee y corrige el texto

    El texto reconocido aparece listo para seleccionar y copiar. Revisa los pasajes que al OCR le cuestan: nombres poco habituales, cifras y todo lo que esté impreso en letra pequeña.

Por qué usarlo

La imagen nunca sale de tu dispositivo

El reconocimiento se ejecuta en el navegador con WebAssembly, así que una nómina, un documento de identidad o un resultado médico no se sube a ninguna parte, tampoco a nosotros.

No vuelvas a teclear nada

Una referencia, una dirección o un párrafo fotografiado en una pantalla se convierte en texto que puedes pegar, en lugar de algo que copias a mano y en lo que te equivocas.

Te avisa si no encontró nada

Una imagen sin texto legible genera un aviso claro que sugiere otro idioma o una imagen más nítida, en lugar de un recuadro vacío que tengas que interpretar.

Preguntas frecuentes

¿Se sube mi imagen?
No. El reconocimiento se ejecuta por completo en tu navegador mediante Tesseract compilado a WebAssembly. La imagen se lee en local y nunca se envía a nuestros servidores, por eso la herramienta es adecuada para un documento que prefieres no subir a ninguna parte.
¿Qué idiomas admite?
Dos ajustes: inglés con francés como secundario, y francés con inglés como secundario. Elige el que corresponda al idioma dominante de la imagen: equivocarte empeora notablemente el resultado, sobre todo con texto acentuado.
¿Por qué la primera vez es más lenta?
Porque el modelo de idioma, de cinco a quince megabytes, se descarga en tu navegador la primera vez que lo usas. Después se conserva, así que las siguientes extracciones empiezan al instante.
¿Qué precisión tiene?
Depende de la imagen, y la diferencia es grande. Un texto impreso nítido, bien iluminado, de frente y con una resolución razonable se lee bien. Una foto borrosa, un ángulo inclinado, poca luz, un fondo recargado o la escritura a mano producirán errores. Revisa siempre las cifras y los nombres propios: es donde el OCR falla con más frecuencia y donde un error cuesta más.
¿Puedo usarlo con un PDF?
Esta herramienta trabaja con imágenes. Para un PDF escaneado, usa la herramienta de OCR, que procesa el documento página a página y le añade una capa de texto.
¿Necesito una cuenta?
Sí. El reconocimiento en sí es local, pero la herramienta está dentro del espacio de trabajo con sesión iniciada. Crear una cuenta es gratis.