Imagen a texto (OCR)
Elige una foto, una captura de pantalla o un PDF escaneado y el texto reconocido aparece listo para copiar. El reconocimiento se ejecuta en tu dispositivo con el motor de código abierto Tesseract.
El reconocimiento se ejecuta en tu navegador. El motor y el modelo de idioma se obtienen de un CDN la primera vez; tus archivos nunca se suben.
Sobre esta herramienta
El reconocimiento óptico de caracteres convierte imágenes de texto en texto editable: la foto de una página, la captura de un mensaje de error, un contrato escaneado. Esta herramienta ejecuta Tesseract, el motor OCR de código abierto, compilado a WebAssembly para funcionar dentro de tu navegador. El motor y el modelo del idioma elegido se descargan de una red de distribución de contenidos la primera vez y se guardan en caché; tus imágenes se procesan localmente y nunca se suben.
La precisión depende de la entrada: un texto nítido, recto y con buen contraste en un idioma que el modelo conoce se lee casi a la perfección, mientras que las fotos de baja resolución, la escritura a mano y las fuentes decorativas empeoran rápido. En los PDF escaneados, cada página se renderiza y reconoce por turno. Elegir el idioma correcto importa porque el modelo usa su diccionario para resolver caracteres ambiguos.
Preguntas frecuentes
- ¿Se suben mis imágenes?
- No. El reconocimiento ocurre en tu navegador. Solo el motor OCR y los datos del idioma se obtienen de un CDN, y no contienen nada tuyo.
- ¿Por qué la primera vez es lenta?
- El motor y el modelo del idioma, unos pocos megabytes, se descargan una vez. Las siguientes ejecuciones los reutilizan desde la caché.
- ¿Lee escritura a mano?
- Rara vez. Tesseract está entrenado con texto impreso; las mayúsculas de imprenta claras a veces funcionan, la cursiva no.
- ¿Cómo mejoro la precisión?
- Usa una imagen nítida con el texto recto y de al menos unos 30 píxeles de alto, recorta lo que sobre y elige el idioma correcto.