HTML to Markdown
NuevoConvert HTML to clean Markdown — pastes, imports files, and handles lists, tables and code.
Runs entirely in your browser. Nothing is uploaded.
¿Por qué convertir HTML a Markdown?
Markdown se ha convertido en el formato de texto plano estándar para escritura técnica, documentación y contenido orientado a desarrolladores. A diferencia del HTML, se lee con naturalidad en su forma cruda, funciona en cualquier editor de texto, se versiona limpiamente con Git y tiene soporte nativo en plataformas como GitHub, GitLab, Notion, Obsidian y todos los generadores de sitios estáticos importantes. Cuando el contenido ya existe en HTML — procedente de un CMS, un artículo extraído, un correo electrónico o una plataforma de documentación heredada — convertirlo a Markdown habilita todos estos flujos de trabajo sin reformateo manual.
En 2026, existe una razón práctica adicional: los sistemas de IA y LLM prefieren claramente Markdown sobre HTML sin procesar. Las investigaciones demuestran que el Markdown reduce el uso de tokens entre un 68–87% en comparación con HTML crudo para el mismo contenido. Al incorporar documentación en un sistema de generación aumentada por recuperación (RAG), o al preparar datos de entrenamiento para un modelo ajustado, convertir HTML a Markdown primero es ya una práctica estándar. Perplexity, ChatGPT y Gemini convierten internamente el contenido web a representaciones similares a Markdown antes de procesarlo, por lo que proporcionarles Markdown directamente omite un paso de conversión con pérdidas.
Cómo funciona la conversión HTML a Markdown basada en DOM
En lugar de aplicar expresiones regulares frágiles a cadenas HTML sin procesar — un enfoque que falla con etiquetas malformadas, elementos anidados y casos límite — esta herramienta analiza tu HTML en un árbol DOM real usando el analizador incorporado del navegador. Luego recorre cada nodo de forma recursiva, mapeando los tipos de elementos a sus equivalentes en Markdown. Los elementos de bloque (encabezados, párrafos, listas, bloques de código) reciben saltos de línea dobles para que el Markdown se renderice correctamente. Los elementos en línea (negrita, cursiva, código, enlaces) producen su sintaxis Markdown dentro del contenido circundante.
Este enfoque basado en DOM es la misma técnica utilizada por Turndown.js, la principal biblioteca JavaScript para conversión de HTML a Markdown con más de 2,5 millones de descargas semanales en npm. Maneja casos límite que los convertidores basados en expresiones regulares pasan por alto: listas anidadas dentro de citas, código dentro de elementos de lista, etiquetas de anclaje que envuelven imágenes y celdas de tabla profundamente anidadas. Los elementos HTML estructurales desconocidos como div, section y article simplemente transmiten sus elementos secundarios sin que ningún contenido se pierda silenciosamente.
Casos de uso frecuentes: migración de CMS, Notion, documentación en GitHub
La migración de CMS es el caso de uso profesional más común. Los equipos que migran de WordPress, Confluence, SharePoint o Ghost a una plataforma moderna basada en Markdown usan la conversión de HTML a Markdown para procesar el contenido exportado. La exportación de WordPress proporciona bloques de contenido HTML; Confluence exporta páginas como HTML o XHTML. Ambos se convierten limpiamente. Los archivos Markdown resultantes se confirman en un repositorio Git, se importan a Notion mediante su función de importación de Markdown, o se incorporan a un generador de sitios estáticos como Docusaurus, MkDocs o Astro.
La gestión del conocimiento personal es otro caso de uso habitual. Herramientas como Obsidian y Logseq están construidas en torno a archivos Markdown. Cuando encuentras un artículo o página de documentación que quieres archivar en tu base de conocimiento, este convertidor te permite pegar el HTML de la página y obtener un archivo Markdown limpio en segundos, conservando la estructura sin el ruido de las etiquetas HTML sin procesar. El recuento de palabras mostrado ayuda a confirmar que no se perdió ningún contenido durante la conversión.
Pandoc vs convertidores en el navegador: cuándo usar cada uno
Pandoc es el estándar de referencia para la conversión de documentos en pipelines profesionales — una herramienta de línea de comandos que convierte entre decenas de formatos, incluido HTML a Markdown, Markdown a PDF y muchos otros. Maneja casos límite como listas de definiciones, notas al pie y estructuras anidadas complejas, y admite más variantes de salida que cualquier convertidor JavaScript: MultiMarkdown, Pandoc Markdown, AsciiDoc, reStructuredText y más. Si estás construyendo un pipeline de conversión por lotes automatizado en un servidor, Pandoc es la opción correcta.
Para conversiones puntuales, migraciones rápidas de contenido o trabajo con material confidencial que no debe salir de tu dispositivo, un convertidor en el navegador es más rápido y práctico. Sin nada que instalar, sin línea de comandos que aprender y con resultados instantáneos. Esta herramienta cubre la gran mayoría de estructuras HTML del mundo real — encabezados, párrafos, listas, tablas, bloques de código, enlaces, imágenes — lo que la convierte en la opción práctica para las necesidades cotidianas de conversión de HTML a Markdown. Markdownify y h2m son alternativas npm sólidas si necesitas automatizar conversiones en Node, pero requieren una configuración de proyecto que esta herramienta omite por completo.
Referencia de sintaxis Markdown y compatibilidad de salida
Convenciones clave de Markdown que sigue esta herramienta: los encabezados usan # hasta ###### para h1–h6, la negrita envuelve el texto en **dobles asteriscos**, la cursiva en *asteriscos simples*, el código en línea entre comillas invertidas y los bloques de código entre triple comilla invertida con un identificador de lenguaje opcional. Los enlaces siguen el patrón [texto](url) y las imágenes usan . Las listas no ordenadas usan un guion como prefijo; las listas ordenadas usan números seguidos de un punto. Las citas prefijan cada línea con >.
Las tablas usan caracteres de barra vertical para separar columnas, con una fila separadora de guiones (y dos puntos opcionales para alineación) después de la fila de encabezado. El tachado envuelve el texto en ~~dobles tildes~~. La salida sigue el CommonMark con extensiones de GitHub Flavored Markdown (GFM), lo que la hace compatible con GitHub, GitLab, vista previa de VS Code, Notion, Obsidian y prácticamente todos los renderizadores de Markdown modernos. Si observas diferencias de renderizado entre plataformas, casi siempre se deben a que la plataforma usa una variante de Markdown no estándar, no a un problema con la salida.
Privacidad, sin límites y soporte móvil
Este convertidor de HTML a Markdown funciona 100% en tu navegador. Nada se sube a un servidor, nada se registra y no se necesita ninguna cuenta. Eso significa que es seguro pegar documentación confidencial, wikis internas o contenido de clientes — nunca sale de tu dispositivo. Incluso puedes desconectarte de internet después de que la página carga y seguirá funcionando, lo que es la prueba más simple de que no hay ningún servidor involucrado.
No hay límite de tamaño de archivo, ni cuota diaria de conversiones, ni muro de pago. Los convertidores en línea que procesan archivos en el servidor, como algunos envoltorios web de Pandoc o APIs de conversión de documentos, suelen limitar el tamaño de los archivos a 1–5 MB o restringen a los usuarios gratuitos a unas pocas conversiones por día. Esta herramienta no tiene ninguna de esas restricciones. También funciona en iPhone y Android — pega HTML desde el navegador de tu móvil, conviértelo y copia el resultado en Markdown directamente en Notion, Obsidian o cualquier otra app, todo gratis y sin registro.
Frequently asked questions
¿Qué elementos HTML admite este convertidor?
El convertidor gestiona encabezados (h1–h6), párrafos, negrita, cursiva, tachado, código en línea, bloques de código delimitados, citas, reglas horizontales, enlaces, imágenes, listas ordenadas, listas no ordenadas, listas anidadas y tablas — cubriendo el conjunto completo de características de CommonMark y GitHub Flavored Markdown (GFM). Los elementos estructurales desconocidos como div, section y article transmiten sus elementos secundarios de forma transparente, por lo que nunca se pierde contenido. La mayoría del HTML del mundo real — procedente de una exportación de CMS, un artículo extraído o una página de documentación — se convierte limpiamente sin necesidad de ningún postprocesamiento por tu parte.
¿En qué se diferencia de Pandoc o Turndown.js?
Pandoc es un potente convertidor de línea de comandos, pero requiere instalación, un terminal y conocimiento de sus parámetros. Es la herramienta adecuada para pipelines automatizados en el lado del servidor, pero excesiva para una conversión puntual. Turndown.js es la biblioteca JavaScript más utilizada para la conversión de HTML a Markdown — con más de 2,5 millones de descargas semanales en npm y más de 10.800 estrellas en GitHub — y esta herramienta usa el mismo enfoque de análisis basado en DOM que hace que Turndown sea fiable. La diferencia es que todo funciona en tu navegador: sin instalación, sin línea de comandos, sin ida y vuelta al servidor y sin que ningún archivo salga de tu dispositivo. Turndown requiere la configuración de un proyecto Node; esta herramienta no.
¿Por qué convertir HTML a Markdown?
Markdown es el formato de texto plano estándar para escritura técnica, documentación y gestión de contenido. Convertir HTML a Markdown te permite importar contenido a Notion u Obsidian, confirmarlo en un repositorio Git junto con el código, publicarlo mediante generadores de sitios estáticos como Astro, Hugo o Jekyll, o incorporarlo a modelos de IA y LLMs. Investigaciones publicadas en 2024 demuestran que Markdown reduce el uso de tokens entre un 68–87% en comparación con HTML sin procesar cuando se usa con modelos de lenguaje a gran escala — una diferencia real en costo y precisión al construir pipelines RAG o preparar conjuntos de datos de ajuste fino.
¿Puedo usarlo para migración de CMS?
Sí — la migración de CMS es uno de los casos de uso profesional más comunes. Pega el HTML exportado desde WordPress, Confluence, SharePoint, Ghost u otra plataforma y obtén Markdown limpio que puedes importar a un nuevo sistema. La exportación de WordPress proporciona bloques de contenido HTML; Confluence exporta páginas como HTML o XHTML — ambos se convierten limpiamente. Para mejores resultados, pega solo el cuerpo del contenido en lugar del HTML completo de la página, incluida la navegación y el pie de página. Los equipos han usado la conversión de HTML a Markdown en el navegador para migrar sitios de documentación de 150 a 200 páginas en menos de dos días, sin necesidad de tocar la línea de comandos.
¿Cómo se convierten las tablas HTML a Markdown?
Las tablas se convierten al formato de tabla de barras verticales de GitHub Flavored Markdown (GFM), con una fila separadora de guiones tras la fila de encabezado. Ese formato funciona en GitHub, GitLab, vista previa de VS Code, Notion, Obsidian, Docusaurus y prácticamente todos los renderizadores de Markdown modernos. Las tablas anidadas se aplanan porque el Markdown estándar no las admite de forma nativa. La alineación de columnas — izquierda, centro, derecha mediante el atributo align o text-align de CSS — se conserva usando la colocación de dos puntos en la fila separadora (p. ej., :--- para izquierda, :---: para centro, ---: para derecha).
¿El convertidor funciona sin conexión?
Sí. La conversión ocurre completamente en tu navegador usando el analizador DOM incorporado — no se suben archivos y no se requiere conexión a internet después de que la página carga. Esto lo hace seguro para usar con HTML confidencial, como documentación interna, referencias de API propietarias o trabajo de clientes que no debería salir de tu dispositivo. Puedes verificarlo: abre las herramientas de desarrollador del navegador, ve a la pestaña de Red y confirma que no se realizan solicitudes de red cuando pegas HTML y ejecutas una conversión. Nada sale de tu equipo.
¿Qué hace la opción 'Eliminar espacios en blanco adicionales'?
Elimina los espacios y tabulaciones al final de cada línea en la salida Markdown y reduce múltiples líneas en blanco consecutivas a una sola línea en blanco. Esto mantiene los archivos limpios y evita espacios en blanco invisibles que pueden afectar el renderizado en analizadores de Markdown estrictos — especialmente el de GitHub, que marca los espacios en blanco al final como un problema de linting. También facilita la incorporación de la salida en herramientas de documentación que ejecutan comprobaciones de espacios en blanco. La opción es segura de dejar activada en casi todos los casos. Solo en muy raras ocasiones los espacios en blanco al final tienen significado semántico.
¿Las listas anidadas se convierten correctamente?
Sí. Los elementos ul y ol anidados se procesan de forma recursiva y cada nivel se sangra correctamente en la salida Markdown. El anidamiento mixto — listas ordenadas dentro de listas no ordenadas, o viceversa — también se maneja correctamente. Una lista no ordenada de tres niveles de profundidad dentro de una lista ordenada, por ejemplo, recibe una sangría adecuada de cuatro espacios en cada nivel, que es el estándar CommonMark. Este es uno de los casos límite donde los convertidores basados en expresiones regulares frecuentemente fallan y producen Markdown roto. El análisis basado en DOM lo maneja de forma fiable.
¿Qué variante de Markdown usa la salida?
La salida sigue CommonMark con extensiones de GitHub Flavored Markdown (GFM) para tablas y tachado. CommonMark es la especificación estandarizada usada por la mayoría de las plataformas, y GFM añade la sintaxis de tabla con barras verticales y el tachado con ~~ que soportan GitHub, GitLab y VS Code. Esto hace que la salida sea compatible con GitHub, GitLab, VS Code, Notion, Obsidian, Docusaurus, MkDocs y la mayoría de los renderizadores de Markdown modernos. Si necesitas CommonMark estricto sin extensiones GFM, las tablas son el único elemento que diferiría — todo lo demás es idéntico.
¿Puedo convertir una página web completa a Markdown?
Puedes pegar cualquier fragmento HTML o el cuerpo completo de una página. Para mejores resultados, pega solo el área de contenido principal — no el documento completo con navegación, barra lateral y pie de página — para que la salida se centre en el contenido significativo. La mayoría de los desarrolladores copian solo el div del artículo o la documentación desde el panel Elementos de las DevTools del navegador (clic derecho → Copiar → Copiar outerHTML). Eso proporciona HTML de contenido limpio sin el esqueleto estructural de la página. El convertidor también maneja HTML de página completa, pero la salida incluirá el texto de navegación convertido como una lista plana de enlaces, que generalmente no es lo que se busca.
¿Por qué Markdown es mejor que HTML para IA y LLMs en 2026?
Los sistemas de IA como Perplexity, ChatGPT y Gemini ahora leen, fragmentan y reutilizan contenido web para generar respuestas. Markdown es su formato de entrada preferido porque elimina las etiquetas de estructura HTML que consumen tokens sin añadir significado semántico. Un párrafo envuelto en etiquetas <p class="article-body"> cuesta más tokens que el mismo párrafo en Markdown plano. Investigaciones publicadas en 2024 muestran que Markdown reduce el uso de tokens entre un 68–87% en comparación con HTML crudo para el mismo contenido — lo que reduce directamente el costo de la API y mejora la relación señal-ruido para los pipelines de generación aumentada por recuperación (RAG).
¿Cómo se gestionan el código en línea y los bloques de código?
Los elementos de código en línea (etiquetas code que no están dentro de pre) se envuelven en comillas invertidas simples. Los bloques de código (elementos pre > code) se envuelven en bloques delimitados de triple comilla invertida, el estándar CommonMark y GFM. Si el elemento code tiene una clase como 'language-python' o 'lang-python', el identificador de lenguaje se extrae y se conserva en la apertura del bloque para el resaltado de sintaxis. Los bloques de código convertidos desde páginas README de GitHub o sitios de documentación conservan sus etiquetas de lenguaje en la salida, por lo que el resaltado de sintaxis que tenías en HTML se mantiene en Markdown.
¿Cómo se compara esto con Markdownify o h2m?
Markdownify y h2m son paquetes npm de Node.js para la conversión programática de HTML a Markdown en un pipeline de construcción. Son la opción correcta cuando necesitas automatizar la conversión de cientos de archivos en un script. Esta herramienta en el navegador cubre el caso de uso que ellos no cubren: conversiones puntuales rápidas, contenido que no puedes compartir con un servidor y situaciones en las que no quieres configurar un proyecto Node en absoluto. La calidad de conversión es similar — los tres usan análisis basado en DOM en lugar de expresiones regulares — pero esta herramienta añade una vista previa en vivo, botón de copiar y recuentos de caracteres y palabras que la hacen más práctica para el trabajo de contenido.
¿Esta herramienta funciona en iPhone y Android?
Sí, el convertidor funciona completamente en navegadores móviles. Pega HTML del portapapeles, ejecuta la conversión y copia el resultado en Markdown — todo desde un teléfono o tableta. La interfaz se adapta a pantallas más pequeñas con paneles apilados. Probado en Safari para iOS 17 y Chrome para Android 14. Un caso de uso móvil común: tomar el HTML de un artículo desde el menú Compartir del navegador, convertirlo y pegar el Markdown directamente en Obsidian o Notion en el mismo dispositivo, sin necesidad de una computadora. Sin registro, sin descarga de app, sin límites.
¿Qué ocurre con los comentarios HTML y las etiquetas script/style?
Los comentarios HTML (<!-- ... -->) se eliminan de la salida ya que Markdown no tiene sintaxis de comentarios y los comentarios raramente forman parte del contenido real. Las etiquetas script y su contenido también se descartan — el JavaScript no tiene significado en Markdown. Las etiquetas style y los atributos de estilo en línea también se eliminan; el estilo CSS no se traduce a Markdown, y el significado semántico (negrita, cursiva, encabezado) se conserva mediante el tipo de elemento en lugar del estilo visual. Si un span está en negrita mediante CSS en lugar de una etiqueta strong o b, ese estilo no se transferirá — lo cual es el comportamiento correcto para una conversión de formato de contenido.
¿Hay un límite de tamaño de archivo o de caracteres?
No. No hay ningún servidor involucrado, por lo que no hay límite de tamaño más allá de lo que la memoria de tu navegador puede manejar. En la práctica, el analizador DOM del navegador puede gestionar varios megabytes de HTML sin problemas — mucho más que cualquier página real de CMS. Si estás convirtiendo un archivo HTML extremadamente grande (la exportación completa de un libro, un artículo muy largo extraído de la web), pégalo en secciones en lugar de todo de una vez para obtener la salida más clara. La conversión en sí toma milisegundos independientemente del tamaño porque se ejecuta directamente en JavaScript en la pestaña de tu navegador.
Related tools
Ver todas las herramientasConversor de columnas de hoja de cálculo
Convierte el número de una columna de hoja de cálculo a su letra (1 → A) y viceversa.
Generador de srcset
Crea código <img> responsivo con srcset y sizes a partir de tus anchos.
Probador de regex
Prueba expresiones regulares con resaltado de coincidencias en vivo, grupos de captura y vista previa de reemplazo.
JSON Schema Validator
Validate JSON against a JSON Schema (draft-07 / draft-2020-12) with clear error messages.
YAML Formatter
Validate, beautify, and convert YAML online. Real-time syntax highlighting, error detection with line numbers, and one-click JSON export.
Formateador de JSON
Embellece, minifica y valida JSON con avisos de error al instante.