Cómo extraer texto de un PDF
- Arrastra tu PDF a la caja de arriba o pulsa Choose a file.
- Elige cómo se separan las páginas con la opción Separadores de página: marcadores de página, una línea en blanco o un único bloque continuo.
- Pulsa PDF a Texto y deja que lea cada página.
- Copia el texto al portapapeles o descárgalo como archivo .txt.
¿Por qué convertir un PDF en texto plano?
Un PDF está hecho para mirarse, no para editarse. Eso es justo lo que lo hace frustrante en cuanto necesitas las palabras que hay dentro. Quieres citar dos párrafos de un informe en un correo, sacar una cláusula de un contrato, pasar un artículo a un resumidor o a un traductor, o buscar en un documento que tu lector de PDF se empeña en no dejarte buscar, y no hay un simple botón de “dame el texto”.
Esta herramienta lee el texto directamente del PDF y te lo devuelve como texto plano y editable. Una vez que es texto plano puedes hacer cualquier cosa con él: pegarlo en un documento, pasarlo por un contador de palabras o un corrector, meterlo en una hoja de cálculo o entregárselo a cualquier herramienta que espere texto plano en lugar de un PDF bloqueado. Es la forma más rápida de pasar de “un PDF que me han enviado” a “texto que puedo usar”.
De forma predeterminada, cada página se etiqueta con un marcador --- Page N --- para que veas exactamente dónde acaba una página y empieza la siguiente, útil cuando citas una fuente o saltas a una página concreta. Si prefieres un único bloque limpio sin nada de por medio, cambia la opción Separadores de página a una línea en blanco o a sin separadores.
Una nota honesta sobre lo que obtienes. Un PDF no guarda líneas de texto ordenadas; guarda muchos fragmentos pequeños posicionados en la página. Esta herramienta los vuelve a unir en texto legible página a página, lo que es perfecto para leer, citar y reprocesar, pero los saltos de línea exactos, los diseños a varias columnas y las cuadrículas de las tablas se aplanan en lugar de reconstruirse a la perfección. Obtienes las palabras, no una copia píxel a píxel de la página.
PDF con texto frente a PDF escaneado
Hay dos tipos de PDF, y solo uno se puede convertir en texto. Un PDF con texto, cualquier cosa exportada desde Word, Google Docs, LaTeX o una app de diseño, lleva el texto real de la página como datos, que es justo lo que extrae esta herramienta. Un PDF escaneado es en realidad un montón de fotografías de papel; dentro no hay palabras, solo píxeles, así que la extracción de texto no encuentra nada.
Cuando la herramienta lee tu documento y no halla prácticamente texto en ninguna página, no te entrega un archivo en blanco en silencio, sino que descarga un breve aviso que explica que el PDF parece escaneado o solo de imagen. Para sacar texto de un documento escaneado necesitas primero un OCR (reconocimiento óptico de caracteres) que lea los píxeles y añada una capa de texto real, tras lo cual esta herramienta puede extraerlo con normalidad.
Tus documentos nunca salen de tu dispositivo
Contratos, escritos legales, manuscritos inéditos, informes financieros: los PDF de los que más quieres extraer texto suelen ser los que menos quieres entregar al servidor de un desconocido. Muchos conversores de “PDF a texto” en línea te piden exactamente eso: subir el archivo, dejar que su servidor lo procese y confiar tu documento privado a su política de retención.
Esta herramienta funciona al revés. Ejecuta PDF.js, el motor de PDF de código abierto creado por Mozilla y usado dentro de Firefox, directamente en la pestaña de tu navegador. El texto se extrae en tu propia máquina. No se sube nada, no hace falta cuenta y ningún servidor ve un solo byte de tu documento. Tampoco hay espera de subida: incluso un PDF grande empieza a extraerse de inmediato.
Usos comunes
- Citar un pasaje de un informe, un artículo o un contrato sin volver a teclearlo.
- Pasar el texto de un PDF a un resumidor, un traductor, un corrector o un contador de palabras.
- Rescatar el texto de un PDF que tu lector no te deja seleccionar ni buscar.
- Obtener texto plano y editable de un documento que un compañero envió como PDF.
- Extraer texto página a página para citas, usando los marcadores de página integrados.

