Cómo extraer texto de una imagen
- Suelta tu captura de pantalla o foto en el recuadro de arriba, o haz clic en Elegir archivos, puedes seleccionar una imagen o un lote completo.
- Elige el Idioma del texto que coincida con el idioma escrito en la imagen (el inglés es el valor por defecto).
- Haz clic en Extraer texto y espera a que termine la barra de progreso, el reconocimiento se ejecuta enteramente en tu dispositivo, así que la velocidad depende de tu ordenador o teléfono.
- Descarga el resultado: cada imagen produce su propio archivo
.txtcon el texto reconocido.
¿Por qué extraer texto de una imagen?
El texto atrapado dentro de una imagen es texto que no puedes buscar, copiar, editar ni traducir. Una captura de una cláusula de contrato, la foto de una pizarra, un recibo escaneado, la foto de un artículo impreso, una conversación de chat capturada como imagen, en cada uno de estos casos las palabras están visualmente ahí pero funcionalmente bloqueadas, porque un archivo de imagen es solo píxeles para cualquier otro programa de tu ordenador.
El reconocimiento óptico de caracteres (OCR) resuelve esto analizando las formas de la imagen y reconstruyendo los caracteres reales, convirtiendo una imagen en texto plano que puedes pegar en un documento, buscar con Ctrl+F, pasar por un traductor, o volcar en una hoja de cálculo. Esta herramienta usa Tesseract, el motor de OCR de código abierto originalmente desarrollado por HP y ahora mantenido por Google (la misma tecnología de reconocimiento detrás de muchas apps comerciales de escaneo) compilado a WebAssembly para que se ejecute directamente en tu pestaña del navegador en lugar de en un servidor.
La precisión depende de lo que le des. Las capturas limpias de texto tecleado (mensajes de chat, diálogos de error, artículos, hojas de cálculo) suelen salir casi perfectas. Las fotos de documentos impresos funcionan bien cuando la toma está nítida, bien iluminada y razonablemente de frente. La letra manuscrita, las fotos de baja resolución, el desenfoque/rotación pronunciados, y los fondos recargados detrás del texto reducen todos la precisión, el OCR es muy bueno, no infalible, así que siempre échale un vistazo rápido al resultado antes de confiar en él.
Tus imágenes nunca salen de tu dispositivo
Las fotos con las que merece la pena ejecutar OCR suelen ser las más sensibles que posees: un documento de identidad fotografiado, la página de un contrato o alquiler, un formulario médico, un extracto bancario, la captura de una conversación privada. La mayoría de las herramientas de OCR online te piden subir exactamente esa imagen a sus servidores, donde puede quedarse en registros o en un contenedor de almacenamiento temporal sobre el que no tienes visibilidad, y los planes gratuitos suelen limitar cuántas páginas puedes procesar antes de pedirte pagar o registrarte.
SysFenix funciona al revés: el motor de OCR completo se descarga una vez en tu pestaña del navegador (de la misma manera que las herramientas de vídeo y PDF de este sitio cargan sus motores de procesamiento) y cada reconocimiento se ejecuta localmente en la CPU de tu propio dispositivo. Nada sobre la imagen, y nada sobre el texto que contiene, se transmite jamás a ningún sitio. Cierra la pestaña y no queda nada en ningún sitio salvo tu propio archivo .txt descargado.
Usos habituales
- Copiar texto de una captura de pantalla en lugar de volver a escribirlo a mano.
- Digitalizar un recibo, factura o nota impresa con aspecto manuscrito fotografiada para el seguimiento de gastos.
- Hacer que un documento escaneado o fotografiado sea buscable y fácil de traducir.
- Extraer una cita o pasaje de la foto de la página de un libro o un artículo impreso.
- Recuperar texto de un chat, correo o documento del que solo tienes una captura de pantalla.