ConvertOwl

HTML zu Markdown — Web-Inhalte in reines Markdown umwandeln

Wandle HTML-Dokumente, Website-Inhalte oder CMS-Exporte in sauberes Markdown um. Nützlich für die Migration von Inhalten zwischen Plattformen, das Archivieren von Webseiten als reinen Text oder das Extrahieren von Inhalten zur Bearbeitung in einem Markdown-Editor. Die turndown-Bibliothek wandelt Überschriften, Absätze, Listen, Links, Bilder, Codeblöcke und Tabellen um und entfernt dabei unnötige HTML-Tags.

So verwendest du dieses Tool

  1. Füge dein HTML ein

    Füge HTML-Quellcode, einen Website-Abschnitt, eine E-Mail-Vorlage oder aus einem CMS exportiertes HTML ein. Sowohl vollständige HTML-Dokumente als auch HTML-Fragmente (ohne doctype) funktionieren.

  2. Klicke auf Konvertieren

    turndown parst das HTML und wandelt semantische Elemente in Markdown um: <h1> → # Überschrift, <strong> → **fett**, <a href="..."> → [Text](url), <ul><li> → - Element, <code> → `Code`.

  3. Überprüfe das Markdown

    Komplexe HTML-Layouts (mehrspaltig, verschachtelte Tabellen) werden möglicherweise nicht perfekt umgewandelt — überprüfe die Ausgabe und passe sie manuell an. Einfache Inhalte wie Artikel, Blogbeiträge und Dokumentationen werden sauber umgewandelt.

  4. Kopieren oder herunterladen

    Kopiere das Markdown, um es in einen Markdown-Editor wie Obsidian, Notion oder Bear einzufügen, oder lade es als .md-Datei herunter.

Häufig gestellte Fragen

Welche HTML-Elemente werden unterstützt?

Alle Standard-Dokumentelemente: Überschriften (h1–h6), Absätze, Fett-/Kursiv-/Durchgestrichen-Formatierung, Links (mit title-Attributen), Bilder, geordnete und ungeordnete Listen, verschachtelte Listen, Blockzitate, Inline-Code, umrandete Codeblöcke, horizontale Linien und Tabellen. Layout-Elemente wie div und span werden als Block-/Inline-Container behandelt, und ihr Inhalt wird ohne die Tags extrahiert.

Tabellen werden nicht korrekt umgewandelt. Warum?

Markdown-Tabellen erfordern, dass jede Zeile die gleiche Anzahl an Spalten hat, und verschachtelte Tabellen lassen sich in Markdown nicht darstellen. Wenn das Quell-HTML zusammengeführte Zellen (colspan/rowspan), komplexe verschachtelte Tabellen oder inkonsistente Spaltenanzahlen enthält, wird die Umwandlung unvollständig sein. Einfache Datentabellen mit konsistenten Spalten werden sauber umgewandelt.

Kann ich eine vollständige Webseite in Markdown umwandeln?

Ja, aber die Ausgabe enthält dann Navigationsmenüs, Fußzeilen, Seitenleisten und anderes nicht-inhaltliches HTML, das du manuell entfernen musst. Um nur den Artikelinhalt einer Webseite zu extrahieren, ist es besser, das HTML des Hauptinhaltsbereichs zu kopieren (Element untersuchen → outer HTML des article- oder main-Elements kopieren) statt der vollständigen Seitenquelle.

Wie werden Inline-Styles in Markdown umgewandelt?

CSS-Inline-Styles (font-weight: bold, font-style: italic) werden nicht in Markdown-Äquivalente umgewandelt — Markdown kennt kein Konzept für beliebiges CSS. Nur semantische HTML-Tags (<strong>, <em>, <b>, <i>) werden zuverlässig umgewandelt. Bei aus CMS exportiertem HTML, das für die Formatierung Klassen statt semantischer Tags verwendet, geht die Styling-Information verloren.

Warum erscheint manch Inhalt als rohes HTML im Markdown?

turndown wandelt semantische HTML-Elemente um. Nicht-semantische oder unbekannte Elemente (benutzerdefinierte Web-Components, script-/style-Tags, SVG-Elemente) bleiben als rohes HTML im Markdown-Output erhalten (was gültig ist — Markdown erlaubt rohes HTML). Wenn du wirklich reinen Text ohne jegliches HTML möchtest, entferne die rohen HTML-Blöcke nach der Umwandlung manuell.

Funktioniert etwas nicht? Fehler melden