HTML to Markdown
NeuConvert HTML to clean Markdown — pastes, imports files, and handles lists, tables and code.
Runs entirely in your browser. Nothing is uploaded.
Warum HTML in Markdown umwandeln?
Markdown hat sich als Standard-Klartextformat für technisches Schreiben, Dokumentation und entwicklerorientierte Inhalte etabliert. Anders als HTML lässt es sich in roher Form gut lesen, funktioniert in jedem Texteditor, lässt sich sauber mit Git versionieren und wird nativ von Plattformen wie GitHub, GitLab, Notion, Obsidian und allen gängigen Static-Site-Generatoren unterstützt. Wenn Inhalte bereits in HTML vorliegen — aus einem CMS, einem gescrapten Artikel, einer E-Mail oder einer veralteten Dokumentationsplattform — erschließt die Konvertierung zu Markdown all diese Workflows ohne manuelles Neuformatieren.
Im Jahr 2026 gibt es einen weiteren praktischen Grund: KI- und LLM-Pipelines bevorzugen Markdown gegenüber rohem HTML. Forschungsergebnisse zeigen, dass sauberes Markdown den Token-Verbrauch um 68–87 % reduziert im Vergleich zu rohem HTML bei gleichem Inhalt. Wer Dokumentation in ein Retrieval-Augmented-Generation-System (RAG) einspeist oder Trainingsdaten für ein Fine-Tuned-Modell aufbereitet, konvertiert HTML heute standardmäßig zuerst zu Markdown. Perplexity, ChatGPT und Gemini wandeln Webinhalte intern in Markdown-ähnliche Darstellungen um, bevor sie verarbeitet werden — wer ihnen direkt Markdown liefert, spart einen verlustbehafteten Konvertierungsschritt.
Wie DOM-basierte HTML-zu-Markdown-Konvertierung funktioniert
Anstatt fragile reguläre Ausdrücke auf rohe HTML-Zeichenketten anzuwenden — ein Ansatz, der bei fehlerhaften Tags, verschachtelten Elementen und Sonderfällen versagt — parst dieses Werkzeug das HTML mit dem integrierten Browser-Parser in einen echten DOM-Baum. Anschließend wird jeder Knoten rekursiv durchlaufen und die Elementtypen ihren Markdown-Entsprechungen zugeordnet. Blockelemente (Überschriften, Absätze, Listen, Codeblöcke) erhalten doppelte Zeilenumbrüche, damit das Markdown korrekt gerendert wird. Inline-Elemente (Fett, Kursiv, Code, Links) erzeugen ihre Markdown-Syntax direkt im umgebenden Text.
Dieser DOM-basierte Ansatz entspricht der Technik von Turndown.js, der führenden JavaScript-Bibliothek für HTML-zu-Markdown mit über 2,5 Millionen wöchentlichen npm-Downloads. Er bewältigt Sonderfälle, die Regex-basierte Konverter übersehen: verschachtelte Listen in Blockquotes, Code innerhalb von Listenelementen, Anker-Tags, die Bilder umschließen, und tief verschachtelte Tabellenzellen. Unbekannte strukturelle HTML-Elemente wie div, section und article reichen ihre Kindelemente einfach weiter, sodass kein Inhalt stillschweigend verloren geht.
Typische Anwendungsfälle: CMS-Migration, Notion, GitHub-Dokumentation
Die CMS-Migration ist der häufigste professionelle Anwendungsfall. Teams, die von WordPress, Confluence, SharePoint oder Ghost zu einer modernen Markdown-basierten Plattform wechseln, nutzen die HTML-zu-Markdown-Konvertierung, um exportierte Inhalte zu verarbeiten. WordPress-Exporte liefern HTML-Inhaltsblöcke; Confluence exportiert Seiten als HTML oder XHTML — beides konvertiert sauber. Die Markdown-Dateien werden anschließend in ein Git-Repository eingecheckt, über die Markdown-Importfunktion in Notion importiert oder in einen Static-Site-Generator wie Docusaurus, MkDocs oder Astro eingespeist.
Persönliches Wissensmanagement ist ein weiterer häufiger Anwendungsfall. Werkzeuge wie Obsidian und Logseq basieren auf Markdown-Dateien. Wer einen Artikel oder eine Dokumentationsseite in seiner Wissensdatenbank archivieren möchte, kann das Seiten-HTML einfügen und erhält in Sekunden eine saubere Markdown-Datei — mit erhaltener Struktur, ohne das Rauschen roher HTML-Tags. Die Wortanzahl-Anzeige bestätigt, dass bei der Konvertierung kein Inhalt verloren gegangen ist.
Pandoc vs. browserbasierte Konverter: wann was verwenden
Pandoc ist der Goldstandard für Dokumentenkonvertierung in professionellen Pipelines — ein Kommandozeilenwerkzeug, das zwischen Dutzenden von Formaten konvertiert, darunter HTML zu Markdown, Markdown zu PDF und viele weitere. Es behandelt Sonderfälle wie Definitionslisten, Fußnoten und komplexe verschachtelte Strukturen und unterstützt mehr Ausgabeformate als jeder JavaScript-Konverter: MultiMarkdown, Pandoc Markdown, AsciiDoc, reStructuredText und mehr. Wer eine automatisierte Batch-Konvertierungspipeline auf einem Server aufbaut, ist mit Pandoc bestens beraten.
Für einmalige Konvertierungen, schnelle Inhaltsmigrationen oder die Arbeit mit sensiblem Material, das das eigene Gerät nicht verlassen soll, ist ein browserbasierter Konverter schneller und praktischer. Nichts installieren, keine Kommandozeile erlernen, sofortige Ergebnisse. Dieses Werkzeug deckt die große Mehrheit realer HTML-Strukturen ab — Überschriften, Absätze, Listen, Tabellen, Codeblöcke, Links, Bilder — und ist damit die praktische Wahl für den täglichen HTML-zu-Markdown-Bedarf. Markdownify und h2m sind solide npm-Alternativen, wenn Konvertierungen in Node geskriptet werden sollen, erfordern aber ein Projekt-Setup, das dieses Werkzeug überflüssig macht.
Markdown-Syntax-Referenz und Ausgabekompatibilität
Die wichtigsten Markdown-Konventionen, die dieses Werkzeug einhält: Überschriften verwenden # bis ###### für h1–h6, Fettschrift umschließt Text mit **doppelten Sternchen**, Kursivschrift mit *einfachen Sternchen*, Inline-Code mit Backticks und abgegrenzte Codeblöcke mit dreifachen Backticks und optionalem Sprachbezeichner. Links folgen dem Muster [Text](URL) und Bilder verwenden . Ungeordnete Listen nutzen einen Bindestrich als Präfix; geordnete Listen verwenden Zahlen gefolgt von einem Punkt. Blockquotes stellen jeder Zeile ein > voran.
Tabellen verwenden Pipe-Zeichen zur Spaltentrennung, mit einer Trennzeile aus Bindestrichen (und optionalen Doppelpunkten für die Ausrichtung) nach der Kopfzeile. Durchgestrichen umschließt Text mit ~~doppelten Tilden~~. Die Ausgabe folgt CommonMark mit GitHub Flavored Markdown (GFM) Erweiterungen und ist damit kompatibel mit GitHub, GitLab, VS Code Vorschau, Notion, Obsidian und praktisch jedem modernen Markdown-Renderer. Wenn zwischen Plattformen Rendering-Unterschiede auftreten, liegt das fast immer daran, dass die Plattform einen nicht standardkonformen Markdown-Dialekt verwendet — nicht an der Ausgabe selbst.
Datenschutz, keine Limits und mobile Unterstützung
Dieser HTML-zu-Markdown-Konverter läuft zu 100 % im Browser. Nichts wird auf einen Server hochgeladen, nichts protokolliert, und es ist kein Konto erforderlich. Das bedeutet, dass vertrauliche Dokumentationen, interne Wikis oder Kundeninhalte sicher eingefügt werden können — sie verlassen das eigene Gerät nicht. Man kann nach dem Laden der Seite sogar die Internetverbindung trennen, und das Werkzeug funktioniert weiterhin — der einfachste Beweis dafür, dass kein Server beteiligt ist.
Es gibt kein Dateigrößenlimit, kein tägliches Konvertierungskontingent und keine Bezahlschranke. Online-Konverter, die Dateien serverseitig verarbeiten — wie manche Pandoc-Web-Wrapper oder Dokumentenkonvertierungs-APIs — begrenzen die Dateigröße oft auf 1–5 MB oder schränken kostenlose Nutzer auf wenige Konvertierungen pro Tag ein. Dieses Werkzeug hat keine solchen Einschränkungen. Es funktioniert auch auf iPhone und Android — HTML vom Smartphone-Browser einfügen, konvertieren und das Markdown-Ergebnis direkt in Notion, Obsidian oder eine andere App kopieren.
Frequently asked questions
Welche HTML-Elemente unterstützt dieser Konverter?
Der Konverter verarbeitet Überschriften (h1–h6), Absätze, Fettschrift, Kursivschrift, Durchgestrichen, Inline-Code, abgegrenzte Codeblöcke, Blockquotes, horizontale Linien, Links, Bilder, geordnete Listen, ungeordnete Listen, verschachtelte Listen und Tabellen — und deckt damit den vollständigen CommonMark- und GitHub Flavored Markdown (GFM)-Funktionsumfang ab. Unbekannte Strukturelemente wie div, section und article reichen ihre Kindelemente transparent weiter, sodass kein Inhalt verloren geht. Die meisten realen HTML-Strukturen — aus einem CMS-Export, einem gescrapten Artikel oder einer Dokumentationsseite — konvertieren sauber, ohne dass eine Nachbearbeitung erforderlich ist.
Was ist der Unterschied zu Pandoc oder Turndown.js?
Pandoc ist ein leistungsfähiges Kommandozeilenwerkzeug, benötigt aber Installation, ein Terminal und Kenntnisse seiner Parameter. Es ist das richtige Werkzeug für automatisierte serverseitige Pipelines, aber überdimensioniert für eine einmalige Konvertierung. Turndown.js ist die meistgenutzte JavaScript-Bibliothek für HTML-zu-Markdown — über 2,5 Millionen wöchentliche npm-Downloads, mehr als 10.800 GitHub-Sterne — und dieses Werkzeug nutzt denselben DOM-basierten Parsing-Ansatz, der Turndown zuverlässig macht. Der Unterschied: Alles läuft im Browser — keine Installation, keine Kommandozeile, kein Server-Roundtrip, keine Dateien verlassen das eigene Gerät. Turndown erfordert ein Node-Projekt-Setup; dieses Werkzeug nicht.
Warum HTML in Markdown umwandeln?
Markdown ist das standardisierte Klartextformat für technisches Schreiben, Dokumentation und Content-Management. Die Konvertierung von HTML zu Markdown ermöglicht den Import von Inhalten in Notion oder Obsidian, das Einchecken in ein Git-Repository zusammen mit Code, die Veröffentlichung über Static-Site-Generatoren wie Astro, Hugo oder Jekyll oder die Einspeisung in KI-Modelle und LLMs. Forschungsergebnisse aus dem Jahr 2024 zeigen, dass Markdown den Token-Verbrauch um 68–87 % im Vergleich zu rohem HTML reduziert — ein realer Kosten- und Qualitätsunterschied beim Aufbau von RAG-Pipelines oder der Aufbereitung von Fine-Tuning-Datensätzen.
Kann ich dieses Werkzeug für CMS-Migrationen verwenden?
Ja — die CMS-Migration ist einer der häufigsten professionellen Anwendungsfälle. HTML aus WordPress, Confluence, SharePoint, Ghost oder einer anderen Plattform einfügen und sauberes Markdown erhalten, das in ein neues System importiert werden kann. WordPress-Exporte liefern HTML-Inhaltsblöcke; Confluence exportiert Seiten als HTML oder XHTML — beides konvertiert sauber. Für beste Ergebnisse empfiehlt sich das Einfügen nur des Inhaltsteils anstelle des vollständigen Seiten-HTMLs mit Navigation und Fußzeile. Teams haben browserbasierte HTML-zu-Markdown-Konvertierung genutzt, um Dokumentationsseiten mit 150–200 Seiten in weniger als zwei Tagen zu migrieren, ohne die Kommandozeile zu öffnen.
Wie werden HTML-Tabellen zu Markdown konvertiert?
Tabellen werden in das GitHub Flavored Markdown (GFM) Pipe-Tabellenformat konvertiert, mit einer Trennzeile aus Bindestrichen nach der Kopfzeile. Dieses Format funktioniert in GitHub, GitLab, VS Code Vorschau, Notion, Obsidian, Docusaurus und praktisch allen modernen Markdown-Renderern. Verschachtelte Tabellen werden abgeflacht, da Standard-Markdown sie nicht nativ unterstützt. Spaltenausrichtung — links, zentriert, rechts über das align-Attribut oder CSS text-align — wird durch Doppelpunkt-Platzierung in der Trennzeile erhalten (z. B. :--- für links, :---: für zentriert, ---: für rechts).
Funktioniert der Konverter auch offline?
Ja. Die Konvertierung erfolgt vollständig im Browser mithilfe des integrierten DOM-Parsers — keine Dateien werden hochgeladen, und nach dem Laden der Seite ist keine Internetverbindung erforderlich. Das macht es sicher für die Verwendung mit vertraulichem HTML wie interner Dokumentation, proprietären API-Referenzen oder Kundenmaterial, das das eigene Gerät nicht verlassen soll. Das lässt sich überprüfen: Browser-DevTools öffnen, zum Netzwerk-Tab wechseln und bestätigen, dass beim Einfügen von HTML und Auslösen einer Konvertierung null Netzwerkanfragen gesendet werden. Nichts verlässt das eigene Gerät.
Was bewirkt die Option „Zusätzliche Leerzeichen entfernen"?
Sie entfernt abschließende Leerzeichen und Tabulatoren von jeder Zeile der Markdown-Ausgabe und reduziert mehrere aufeinanderfolgende Leerzeilen auf eine einzelne Leerzeile. Das hält Dateien sauber und vermeidet unsichtbare Leerzeichen, die das Rendering in strikten Markdown-Parsern beeinflussen können — insbesondere dem von GitHub, der abschließende Leerzeichen als Lint-Problem hervorhebt. Es macht die Ausgabe auch einfacher zu verwenden in Dokumentationswerkzeugen, die Leerzeichen-Prüfungen durchführen. Die Option kann in fast allen Fällen aktiviert bleiben. Nur sehr selten hat abschließendes Leerzeichen eine semantische Bedeutung.
Werden verschachtelte Listen korrekt konvertiert?
Ja. Verschachtelte ul- und ol-Elemente werden rekursiv verarbeitet, und jede Ebene wird in der Markdown-Ausgabe korrekt eingerückt. Gemischte Verschachtelungen — geordnete Listen innerhalb ungeordneter Listen oder umgekehrt — werden ebenfalls korrekt behandelt. Eine drei Ebenen tiefe ungeordnete Liste innerhalb einer geordneten Liste erhält beispielsweise korrekte Vier-Leerzeichen-Einrückung auf jeder Ebene — das ist der CommonMark-Standard. Dies ist einer der Sonderfälle, bei denen Regex-basierte Konverter häufig versagen und fehlerhaftes Markdown erzeugen. DOM-basiertes Parsing behandelt ihn zuverlässig.
Welchen Markdown-Dialekt verwendet die Ausgabe?
Die Ausgabe folgt CommonMark mit GitHub Flavored Markdown (GFM) Erweiterungen für Tabellen und Durchgestrichen. CommonMark ist die standardisierte Spezifikation, die von den meisten Plattformen verwendet wird; GFM ergänzt die Pipe-Tabellensyntax und ~~ Durchgestrichen, die GitHub, GitLab und VS Code alle unterstützen. Das macht die Ausgabe kompatibel mit GitHub, GitLab, VS Code, Notion, Obsidian, Docusaurus, MkDocs und den meisten modernen Markdown-Renderern. Wer striktes CommonMark ohne GFM-Erweiterungen benötigt, muss nur bei Tabellen Unterschiede beachten — alles andere ist identisch.
Kann ich eine vollständige Webseite zu Markdown konvertieren?
Es können beliebige HTML-Fragmente oder vollständige Seiteninhaltsbereiche eingefügt werden. Für beste Ergebnisse empfiehlt sich das Einfügen nur des Hauptinhaltsbereichs — nicht des vollständigen Dokuments mit Navigation, Sidebar und Fußzeile — damit die Ausgabe auf bedeutungsvolle Inhalte fokussiert bleibt. Die meisten Entwickler kopieren einfach das Artikel- oder Dokumentations-div aus dem Browser-DevTools-Elements-Panel (Rechtsklick → Kopieren → Äußeres HTML kopieren). Das liefert sauberes Inhalts-HTML ohne das strukturelle Seiten-Chrome. Der Konverter verarbeitet auch vollständiges Seiten-HTML, aber die Ausgabe enthält dann Navigationstext als flache Linkliste — was in der Regel nicht das gewünschte Ergebnis ist.
Warum ist Markdown für KI und LLMs im Jahr 2026 besser als HTML?
KI-Systeme wie Perplexity, ChatGPT und Gemini lesen, zerlegen und verarbeiten Webinhalte intern, um Antworten zu generieren. Markdown ist ihr bevorzugtes Eingabeformat, weil es HTML-Strukturtags entfernt, die Token verbrauchen, ohne semantische Bedeutung hinzuzufügen. Ein in <p class="article-body">-Tags eingeschlossener Absatz kostet mehr Token als derselbe Absatz in reinem Markdown. Forschungsergebnisse aus dem Jahr 2024 zeigen, dass Markdown den Token-Verbrauch um 68–87 % im Vergleich zu rohem HTML für denselben Inhalt reduziert — was API-Kosten direkt senkt und das Signal-Rausch-Verhältnis für Retrieval-Augmented-Generation-Pipelines (RAG) verbessert.
Wie werden Inline-Code und Codeblöcke verarbeitet?
Inline-Code-Elemente (code-Tags, die sich nicht innerhalb von pre befinden) werden in einzelne Backticks eingeschlossen. Codeblöcke (pre > code-Elemente) werden in dreifache Backtick-abgegrenzte Blöcke eingeschlossen — der CommonMark- und GFM-Standard. Wenn das code-Element eine Klasse wie 'language-python' oder 'lang-python' hat, wird der Sprachbezeichner extrahiert und im öffnenden Fence für Syntax-Highlighting erhalten. Codeblöcke, die von GitHub-README-Seiten oder Dokumentationsseiten konvertiert werden, behalten ihre Sprach-Tags in der Ausgabe — das Syntax-Highlighting aus dem HTML bleibt im Markdown erhalten.
Wie unterscheidet sich dieses Werkzeug von Markdownify oder h2m?
Markdownify und h2m sind Node.js-npm-Pakete für programmatische HTML-zu-Markdown-Konvertierung in einer Build-Pipeline. Sie sind die richtige Wahl, wenn Konvertierungen über Hunderte von Dateien in einem Skript automatisiert werden müssen. Dieses Browser-Werkzeug deckt den Anwendungsfall ab, den sie nicht abdecken: schnelle Einzelkonvertierungen, Inhalte, die nicht mit einem Server geteilt werden können, und Situationen, in denen kein Node-Projekt aufgesetzt werden soll. Die Konvertierungsqualität ist vergleichbar — alle drei verwenden DOM-basiertes Parsing statt Regex — aber dieses Werkzeug bietet zusätzlich eine Live-Vorschau, einen Kopierpfeil und Zeichen-/Wortanzahlen, die es für die Inhaltsarbeit praktischer machen.
Funktioniert dieses Werkzeug auf iPhone und Android?
Ja, der Konverter funktioniert vollständig in mobilen Browsern. HTML aus der Zwischenablage einfügen, konvertieren und das Markdown-Ergebnis kopieren — alles vom Smartphone oder Tablet aus. Die Oberfläche passt sich kleineren Bildschirmen mit gestapelten Bereichen an. Getestet auf Safari für iOS 17 und Chrome für Android 14. Ein häufiger mobiler Anwendungsfall: das HTML eines Artikels über das Teilen-Menü des Browsers abrufen, konvertieren und das Markdown direkt in Obsidian oder Notion auf demselben Gerät einfügen, ohne einen Desktop zu benötigen. Keine Anmeldung, kein App-Download, keine Limits.
Was passiert mit HTML-Kommentaren und Script-/Style-Tags?
HTML-Kommentare (<!-- ... -->) werden aus der Ausgabe entfernt, da Markdown keine Kommentarsyntax hat und Kommentare selten Teil des eigentlichen Inhalts sind. Script-Tags und deren Inhalte werden ebenfalls entfernt — JavaScript ist in Markdown nicht sinnvoll. Style-Tags und Inline-Style-Attribute werden ebenfalls entfernt; CSS-Styling lässt sich nicht in Markdown übersetzen, und die semantische Bedeutung (Fett, Kursiv, Überschrift) wird über den Elementtyp erhalten, nicht über den visuellen Stil. Wenn ein span durch CSS statt durch ein strong- oder b-Tag fett dargestellt wird, wird dieses Styling nicht übertragen — was das korrekte Verhalten für eine Inhaltsformat-Konvertierung ist.
Gibt es eine Dateigrößen- oder Zeichenbegrenzung?
Nein. Es ist kein Server beteiligt, daher gibt es kein Größenlimit über das hinaus, was der Browserspeicher verarbeiten kann. In der Praxis kann der Browser-DOM-Parser mehrere Megabyte HTML ohne Probleme verarbeiten — weit mehr als jede reale CMS-Seite. Wer eine sehr große HTML-Datei konvertiert (einen vollständigen Buchexport, einen sehr langen gescrapten Artikel), fügt sie für die sauberste Ausgabe abschnittsweise ein. Die Konvertierung selbst dauert unabhängig von der Größe Millisekunden, da sie direkt in JavaScript im Browser-Tab ausgeführt wird.
Related tools
Alle Tools ansehenTabellenspalten-Konverter
Eine Tabellenspalten-Nummer in ihren Buchstaben (1 → A) und zurück umwandeln.
Srcset-Generator
Responsives <img>-Markup mit srcset und sizes aus deinen Breiten erzeugen.
Regex-Tester
Teste reguläre Ausdrücke mit Live-Hervorhebung der Treffer, Capture-Gruppen und Ersetzungsvorschau.
JSON Schema Validator
Validate JSON against a JSON Schema (draft-07 / draft-2020-12) with clear error messages.
YAML Formatter
Validate, beautify, and convert YAML online. Real-time syntax highlighting, error detection with line numbers, and one-click JSON export.
JSON-Formatierer
JSON verschönern, minimieren und validieren — mit sofortigen Fehlerhinweisen.