Convertir Word a HTML

Convierte un .docx de Word en un HTML limpio y con estilo en tu navegador. Sin subir nada, sin cuenta, tu documento nunca sale de tu dispositivo.

🌐 English

Drop your files here (.docx)

🔒 Privado por diseño: tus archivos se procesan localmente en tu navegador; nada se sube nunca a ningún servidor.

Qué lee el conversor dentro de un .docx, y qué descarta sin decirlo

Un .docx es un archivo zip lleno de partes XML, y esta herramienta lo abre con mammoth.js y pide solo la capa semántica. Los estilos Título 1 a Título 6 de Word se convierten en elementos <h1> a <h6> de verdad. La negrita pasa a <strong>, la cursiva a <em>, el tachado a <s>, el superíndice a <sup>. Un hipervínculo se convierte en un <a href> auténtico, con su destino resuelto a través de la parte de relaciones del documento. Los párrafos con viñetas y numerados se reconstruyen como listas <ul> y <ol> anidadas, y el mapa de estilos por defecto cubre cinco niveles de anidamiento antes de que los elementos más profundos caigan a párrafos normales. Cada tabla de Word se convierte en marcado <table>, <tr> y <td>, y una fila marcada en Word como “Repetir como fila de encabezado” llega como un <thead> real de celdas <th>.

Las omisiones importan igual. El subrayado no tiene entrada en ese mapa de estilos por defecto, así que desaparece mientras el texto se queda. El color de resaltado, el color de fuente y el tamaño de fuente corren la misma suerte. Los encabezados y pies viven en partes XML separadas que esta cadena no abre nunca, que es también la razón de que los números de página no puedan pasar: en un archivo HTML no hay páginas que numerar. Los cuadros de texto, las columnas y el espaciado exacto son maquetación, y la maquetación es precisamente lo que estás entregando a cambio de un marcado que puedes reestilizar.

Las notas al pie sobreviven, pero se mudan al final

Pasa un documento con notas al pie y verás cada llamada renderizada como un pequeño enlace en superíndice, más una lista numerada añadida después del último párrafo con el texto de todas las notas y un enlace de flecha de vuelta a su cita. No se pierde nada, pero la experiencia de lectura cambia: lo que era una nota al pie de la página tres es ahora el elemento tres de una lista al final. Para un contrato o un borrador académico eso suele estar bien. Para un documento donde las notas cargaban con mucho peso, conviene saberlo antes de pegar el resultado en una wiki.

Cada archivo que escribe esta herramienta lleva una hoja de estilos dentro

La descarga no es un fragmento pelado. El cuerpo convertido se envuelve en un documento completo con un doctype, una codificación UTF-8 y una hoja de estilos en línea, para que el archivo se abra correctamente directamente desde tu carpeta de descargas. Esa hoja de estilos fija un margen de cuerpo de 40px, una tipografía de palo seco del sistema de 16px con interlineado 1,6, texto casi negro, imágenes limitadas al ancho del contenedor, y tablas con bordes colapsados de un píxel y relleno real en las celdas. Es deliberadamente sobria. Si vas a pegar en un gestor de contenidos la vas a quitar de todas formas, y si no, sobrio es mejor que los atributos mso-, los spans vacíos y las entidades de comillas tipográficas que te habría dado copiar y pegar desde Word.

Diez archivos dentro, uno malo, nada fuera

La zona de arrastre acepta varios .docx a la vez y produce una descarga .html por documento, nombrada a partir del original. Lo que no hace es recuperarse de un miembro roto del lote. No hay manejo de errores por archivo dentro del bucle de conversión, así que un documento corrupto o mal etiquetado aborta la tanda entera y no aparece ninguna descarga. Si un archivo te resulta sospechoso, conviértelo solo. Un .doc renombrado a .docx es el infractor clásico: la comprobación de extensión lo deja pasar por la zona de arrastre, y el lector de zip falla después con él.

Cuatro pasos de la zona de arrastre a la descarga .html

  1. Suelta tus archivos .docx en la caja de arriba, o pulsa Elegir archivos para seleccionarlos.
  2. Repasa la lista que aparece y pulsa el botón de convertir Word a HTML.
  3. Pulsa el enlace de Descargar de cada archivo terminado, uno por documento.
  4. Pulsa Procesar otro si quieres empezar un lote nuevo.

Dónde gana la ruta del HTML a la del PDF

Si tu motivo para convertir es que quieres las palabras, esta es la herramienta a usar y no convertir Word a PDF. Ese conversor comparte la primera mitad de esta misma cadena y después rasteriza la página renderizada en imágenes, así que su texto deja de ser texto. Aquí el marcado es el entregable y todas las palabras siguen siendo seleccionables, buscables y editables. Si lo que quieres es estructura en texto plano en lugar de etiquetas, convertir Word a Markdown ejecuta esta misma conversión y después reescribe el HTML como Markdown. En la dirección contraria, convertir Markdown a HTML acepta Markdown pegado, y convertir HTML a PDF coge el archivo .html que acabas de descargar y lo pagina.

Preguntas frecuentes

¿El HTML conservará los encabezados, negrita/cursiva, listas, tablas e imágenes de mi documento?

Sí. Los encabezados se convierten en elementos `<h1>`–`<h6>` reales, el texto en negrita/cursiva se conserva, las listas con viñetas y numeradas se convierten en listas `<ul>`/`<ol>` reales, las tablas se renderizan como marcado `<table>`/`<tr>`/`<td>` real, y las imágenes incrustadas se conservan (una imagen enlazada a un archivo externo de tu ordenador, en lugar de incrustada en el documento, no se conservará, Word incrusta imágenes por defecto, así que esto es poco común).

¿El texto en el HTML descargado es texto real, seleccionable y buscable?

Sí, esta es la principal ventaja de esta herramienta frente al conversor `docx-to-pdf` de este sitio. Esa herramienta tiene que rasterizar la página en una imagen para producir un PDF sin tener acceso a un motor de impresión real; esta herramienta se detiene un paso antes y te da directamente el marcado HTML real, así que el texto se mantiene completamente real, seleccionable y buscable, no hay ninguna imagen de por medio.

¿Se sube mi documento de Word a un servidor?

No. Tanto leer tu archivo .docx como convertirlo a HTML ocurren localmente en tu pestaña del navegador, usando el mismo JavaScript ya cargado con la página. Tu documento nunca se transmite a ningún sitio, lo cual importa si lo que conviertes es un contrato, un currículum con datos personales, o cualquier otra cosa que prefieras no entregar a los registros de acceso de un servidor de terceros solo para obtener un archivo HTML.

¿Es seguro abrir el HTML de salida, o podría contener un script oculto?

Seguro por construcción: la librería que usa esta herramienta para leer tu archivo .docx siempre escapa el contenido de texto en marcado plano e inerte, no hay ninguna ruta de código que copie texto en bruto de tu documento al HTML como marcado ejecutable en vivo, así que el texto de un documento manipulado no puede inyectar una etiqueta `<script>` ni un manejador de evento estilo `onerror`.

¿Puedo convertir varios documentos de Word a la vez?

Sí, sube varios archivos `.docx` juntos y cada uno se convierte de forma independiente en su propia descarga `.html`, con el nombre del archivo original.

¿Funciona esto con el formato antiguo .doc?

No, solo con el formato moderno `.docx` (el formato basado en XML/ZIP que Word usa por defecto desde Word 2007). El formato binario heredado `.doc` es una estructura de archivo completamente distinta y mucho más antigua que esta herramienta no lee. Si tienes un archivo `.doc`, ábrelo en Word (o Google Docs/LibreOffice) y usa "Guardar como" para guardar primero una copia `.docx`, y luego convierte esa.

¿El HTML se verá exactamente igual que el documento original de Word?

Para documentos centrados en texto (informes, cartas, currículums, contratos) muy parecido, pero no pixel a pixel. Esta herramienta lee la estructura semántica de tu documento (encabezados, párrafos, texto en negrita/cursiva, listas, tablas, imágenes incrustadas) y vuelve a renderizar esa estructura con un estilo limpio y consistente. No replica las fuentes exactas de Word, el espaciado preciso, encabezados/pies de página, notas al pie, números de página ni diseños complejos de varias columnas.

Herramientas relacionadas