Extraer Texto de Imagen (OCR)

Extrae texto de capturas de pantalla y fotos de documentos directamente en tu navegador. OCR gratis, sin subir archivos, sin cuenta y sin marca de agua.

🌐 English

Drop your files here (.jpg, .jpeg, .png, .webp, .bmp)

🔒 Privado por diseño: tus archivos se procesan localmente en tu navegador; nada se sube nunca a ningún servidor.

Cómo extraer texto de una imagen

  1. Suelta tu captura de pantalla o foto en el recuadro de arriba, o haz clic en Elegir archivos, puedes seleccionar una imagen o un lote completo.
  2. Elige el Idioma del texto que coincida con el idioma escrito en la imagen (el inglés es el valor por defecto).
  3. Haz clic en Extraer texto y espera a que termine la barra de progreso, el reconocimiento se ejecuta enteramente en tu dispositivo, así que la velocidad depende de tu ordenador o teléfono.
  4. Descarga el resultado: cada imagen produce su propio archivo .txt con el texto reconocido.

¿Por qué extraer texto de una imagen?

El texto atrapado dentro de una imagen es texto que no puedes buscar, copiar, editar ni traducir. Una captura de una cláusula de contrato, la foto de una pizarra, un recibo escaneado, la foto de un artículo impreso, una conversación de chat capturada como imagen, en cada uno de estos casos las palabras están visualmente ahí pero funcionalmente bloqueadas, porque un archivo de imagen es solo píxeles para cualquier otro programa de tu ordenador.

El reconocimiento óptico de caracteres (OCR) resuelve esto analizando las formas de la imagen y reconstruyendo los caracteres reales, convirtiendo una imagen en texto plano que puedes pegar en un documento, buscar con Ctrl+F, pasar por un traductor, o volcar en una hoja de cálculo. Esta herramienta usa Tesseract, el motor de OCR de código abierto originalmente desarrollado por HP y ahora mantenido por Google (la misma tecnología de reconocimiento detrás de muchas apps comerciales de escaneo) compilado a WebAssembly para que se ejecute directamente en tu pestaña del navegador en lugar de en un servidor.

La precisión depende de lo que le des. Las capturas limpias de texto tecleado (mensajes de chat, diálogos de error, artículos, hojas de cálculo) suelen salir casi perfectas. Las fotos de documentos impresos funcionan bien cuando la toma está nítida, bien iluminada y razonablemente de frente. La letra manuscrita, las fotos de baja resolución, el desenfoque/rotación pronunciados, y los fondos recargados detrás del texto reducen todos la precisión, el OCR es muy bueno, no infalible, así que siempre échale un vistazo rápido al resultado antes de confiar en él.

Tus imágenes nunca salen de tu dispositivo

Las fotos con las que merece la pena ejecutar OCR suelen ser las más sensibles que posees: un documento de identidad fotografiado, la página de un contrato o alquiler, un formulario médico, un extracto bancario, la captura de una conversación privada. La mayoría de las herramientas de OCR online te piden subir exactamente esa imagen a sus servidores, donde puede quedarse en registros o en un contenedor de almacenamiento temporal sobre el que no tienes visibilidad, y los planes gratuitos suelen limitar cuántas páginas puedes procesar antes de pedirte pagar o registrarte.

SysFenix funciona al revés: el motor de OCR completo se descarga una vez en tu pestaña del navegador (de la misma manera que las herramientas de vídeo y PDF de este sitio cargan sus motores de procesamiento) y cada reconocimiento se ejecuta localmente en la CPU de tu propio dispositivo. Nada sobre la imagen, y nada sobre el texto que contiene, se transmite jamás a ningún sitio. Cierra la pestaña y no queda nada en ningún sitio salvo tu propio archivo .txt descargado.

Usos habituales

Preguntas frecuentes

¿Se suben mis imágenes a un servidor?

No. El motor de OCR (Tesseract, compilado a WebAssembly) se ejecuta enteramente dentro de tu pestaña del navegador, y el texto reconocido se escribe en un archivo .txt en tu propio dispositivo. Ni la imagen ni el texto extraído se envían jamás a ningún sitio, algo que importa si la foto es un contrato, un documento de identidad, un formulario médico o una captura de un mensaje privado.

¿Qué idiomas están soportados?

El selector de idioma ofrece actualmente inglés, español, francés, alemán y portugués, una lista deliberadamente corta de idiomas que realmente hemos probado, en lugar de cada idioma que Tesseract puede teóricamente manejar. Elige el idioma en el que realmente esté escrito el texto de tu imagen para la mejor precisión; unos datos de idioma que no coinciden perjudican notablemente el reconocimiento.

¿Qué formatos de imagen y tamaños de archivo funcionan mejor?

Las capturas de pantalla o fotos en JPG, PNG, WebP y BMP funcionan todas. El reconocimiento es más preciso en imágenes nítidas, bien iluminadas y de resolución razonablemente alta con el texto más o menos horizontal, una captura de pantalla tomada de frente funciona mejor que una foto de un documento tomada en ángulo o con poca luz.

¿Puedo extraer texto de varias imágenes a la vez?

Sí. Suelta varias imágenes y cada una produce su propio archivo .txt descargable, procesado una tras otra en tu dispositivo. Los lotes más grandes simplemente tardan más ya que todo se ejecuta en tu propio hardware en lugar de en un servidor.

¿Por qué algunas palabras salieron mal?

La precisión del OCR depende mucho de la calidad de la imagen, el desenfoque, la baja resolución, las fuentes poco habituales, la letra manuscrita y los ángulos torcidos aumentan todos los errores. Tesseract es un motor de OCR maduro y capaz, pero no es perfecto; siempre revisa el texto extraído antes de confiar en él para algo importante.

¿Esto es lo mismo que hacer buscable un PDF escaneado?

No, esta herramienta es para archivos de imagen (capturas de pantalla, fotos) y siempre produce un archivo .txt plano con solo el texto reconocido. Si tu fuente es un PDF escaneado y quieres conservarlo como PDF (buscable con Ctrl+F, con el texto reconocido colocado de forma invisible sobre el aspecto original de cada página) usa en su lugar nuestra herramienta OCR PDF; trabaja directamente sobre el PDF completo en lugar de necesitar que conviertas primero las páginas a imágenes.

Herramientas relacionadas