Conversor de Word a Markdown

Convierte un documento moderno de Word en formato .docx a Markdown limpio y editable sin subirlo. El navegador lee la estructura del documento y conserva los títulos, párrafos, negritas, cursivas, enlaces, listas, citas, estilos de código y tablas sencillas compatibles. Revisa la vista previa segura, copia el resultado o descarga un archivo .md. Las imágenes se sustituyen por un aviso explícito, mientras que el diseño de página y otras funciones exclusivas de Word se indican como limitaciones en lugar de prometerse en silencio.

Cómo convertir un documento de Word a Markdown

  1. 1

    Elige un DOCX

    Abre un archivo `.docx` sin cifrar. El conversor comprueba localmente su estructura ZIP y Office Open XML antes de leerlo.

  2. 2

    Elige los marcadores de Markdown

    Selecciona títulos con almohadillas o subrayado, y guion o asterisco para los elementos de listas sin ordenar.

  3. 3

    Revisa la estructura

    Comprueba la vista previa segura y los avisos sobre imágenes omitidas o funciones de Word que no se trasladan bien a Markdown.

  4. 4

    Copia o descarga

    Copia el Markdown al portapapeles o guárdalo como archivo `.md` UTF-8 con un nombre basado en el DOCX.

De WordprocessingML a Markdown

Un DOCX es un paquete Office Open XML, no un único flujo de texto con formato. Microsoft describe un paquete básico de procesamiento de textos como un conjunto de partes, incluida una parte principal que contiene el cuerpo del documento. Este conversor comprueba primero la estructura esperada del paquete y después utiliza Mammoth.js para producir un HTML semántico intermedio. La propia documentación de Mammoth prioriza la estructura semántica sobre la reproducción exacta del aspecto de Word, que es el límite adecuado para Markdown.

El HTML intermedio se analiza en memoria y se convierte en bloques y elementos en línea de CommonMark. Las tablas sencillas usan la extensión de tablas de GitHub Flavored Markdown. El HTML intermedio nunca se inserta sin procesar. La vista previa se genera a partir de Markdown y se limpia antes de mostrarse.

Estructura de Word Resultado en Markdown Límite de la conversión
Estilos de título Títulos con # o títulos Setext de nivel 1 y 2 El tamaño visual de la letra no define por sí solo un título
Párrafos, negrita, cursiva y tachado Párrafos y marcadores en línea Se omiten fuentes, colores y espaciado preciso
Listas ordenadas y sin ordenar Elementos numerados y con sangría Las numeraciones personalizadas complejas pueden requerir retoques
Hipervínculos [texto](URL) Solo se conservan enlaces web, de correo o a fragmentos que sean seguros
Tablas sencillas Tabla de barras verticales GFM Las celdas combinadas y los diseños complejos se simplifican
Imágenes y objetos incrustados Aviso visible de omisión El contenido multimedia binario no se exporta a Markdown

Ejemplo práctico

Supongamos que un DOCX contiene un título de nivel 1 llamado Estado del proyecto, dos párrafos, un plan numerado de tres pasos y una tabla de 2 × 3 con el responsable y la fecha límite. Si se eligen títulos con almohadillas, el resultado comienza con # Estado del proyecto, seguido de párrafos normales, marcadores de lista 1. y una tabla GFM cuya primera fila pasa a ser la cabecera. Si el mismo documento contiene un gráfico flotante, este no se convierte. La herramienta muestra un aviso de limitación para que la ausencia del objeto no se confunda con una exportación correcta.

Lo que Markdown no puede conservar

Markdown expresa la estructura del contenido, no la paginación de Word. Las páginas, columnas, márgenes, encabezados, pies de página, fuentes, colores, posiciones flotantes, cuadros de texto, gráficos, SmartArt, ecuaciones, macros, objetos OLE, formularios, comentarios y el historial de control de cambios quedan fuera del resultado del conversor. Las tablas complejas con celdas combinadas pueden perder la cuadrícula prevista. Revisa con cuidado los documentos técnicos o regulados y conserva el DOCX original como fuente autorizada.

Límites de archivo y privacidad

El conversor acepta .docx, pero no .doc antiguo, .docm, ODT ni PDF. Rechaza los paquetes que no incluyan las partes esperadas de Office Open XML, las entradas ZIP cifradas, más de 2.000 entradas, más de 25 MiB comprimidos o más de 80 MiB descomprimidos. Estos límites reducen el riesgo para la memoria, pero no reparan archivos dañados.

Los bytes del DOCX, el nombre de archivo, la estructura extraída, los ajustes, la vista previa y el Markdown permanecen en este navegador. En el flujo de varios pasos, un token aleatorio del sessionStorage de esta pestaña apunta durante un máximo de dos horas a un registro de IndexedDB que caduca. El contenido nunca se incluye en la URL ni se envía mediante Livewire. Empezar de nuevo elimina el token de la pestaña y el registro guardado.

Preguntas frecuentes

Utiliza un archivo .docx moderno y sin cifrar. Se rechazan los .doc antiguos, .docm con macros, ODT, PDF, paquetes cifrados, archivos dañados y archivos que superen los límites indicados. Guarda primero los documentos antiguos de Word como DOCX.

El conversor procesa títulos semánticos, párrafos, negrita, cursiva, tachado, enlaces seguros, saltos de línea, listas ordenadas y sin ordenar, citas, estilos de código cuando Word los identifica y tablas GFM sencillas. El estilo visual que no tenga estructura semántica puede no trasladarse correctamente.

Las imágenes reciben un aviso visible de omisión y una advertencia. El diseño de página, las columnas, los encabezados, los pies de página, las fuentes, los colores, los elementos flotantes, las tablas con celdas combinadas, los gráficos, SmartArt, las ecuaciones, las macros, los objetos incrustados, los formularios, los comentarios y el historial de cambios no se reproducen con exactitud.

Word es un sistema de diseño paginado, mientras que Markdown describe una estructura documental ligera. El conversor conserva el significado compatible, no las posiciones de los píxeles, los saltos de página, las fuentes ni el espaciado exacto. Revisa el resultado y realiza los ajustes necesarios antes de publicarlo.

No. Los bytes, el nombre, el contenido, los ajustes, la vista previa y el Markdown permanecen en el navegador y no se envían mediante Livewire ni se incluyen en la URL. La recuperación del flujo usa un registro temporal solo en esta pestaña, y Empezar de nuevo lo elimina.

Herramientas relacionadas