SonuPDF

PDF zu Markdown

Konvertieren Sie PDF-Text mit Strukturerkennung in Markdown.

Drag & drop files here, or click to select

So funktioniert es:

  • Extrahiert Textinhalt aus PDF-Seiten
  • Erkennt Überschriften anhand von Schriftgröße und -stil
  • Identifiziert Aufzählungspunkte und nummerierte Listen
  • Erhält die Seitenstruktur mit Trennzeichen
  • Fügt Seitenzahlkommentare zur Referenz hinzu

Hinweis: Dieses Tool funktioniert am besten mit PDFs, die auswählbaren Text enthalten. Gescannte PDFs oder Bilder liefern keine sinnvollen Ergebnisse. Die Ergebnisse können je nach ursprünglicher Formatierung und Textanordnung des PDFs variieren.

So konvertieren Sie ein PDF in das Markdown-Format

1

Laden Sie Ihre PDF-Datei über die Dateiauswahl hoch oder legen Sie sie im Upload-Bereich ab.

2

Das Tool liest die Textebene jeder Seite und erkennt Überschriften, Listen und Absatzstruktur.

3

Klicken Sie auf Konvertieren, um das Dokument zu verarbeiten und Markdown-Ausgabe zu erstellen.

4

Überprüfen Sie das Markdown im Vorschaufeld, kopieren Sie es in die Zwischenablage oder laden Sie die .md-Datei herunter.

Warum PDF mit SonuPDF in Markdown konvertieren?

file-text

Strukturbewusste Extraktion

Verwendet Schriftgröße und Textposition, um automatisch Überschriften (H1, H2, H3), Aufzählungspunkte, nummerierte Listen und Absatzblöcke zu erkennen.

clipboard

Kopieren oder Herunterladen

Kopieren Sie die Markdown-Ausgabe direkt in Ihre Zwischenablage zur Verwendung in Editoren wie Obsidian, Notion oder GitHub, oder speichern Sie sie als .md-Datei.

layers

Mehrseitige Unterstützung

Jede Seite wird extrahiert und mit horizontalen Trennlinien getrennt, sodass die Struktur langer Dokumente in der Ausgabe erhalten bleibt.

lock

Clientseitiger Datenschutz

Die gesamte Textextraktion erfolgt in Ihrem Browser mit PDF.js. Keine Datei wird auf einen Server hochgeladen, sodass der Inhalt Ihres Dokuments auf Ihrem Gerät bleibt.

Häufig gestellte Fragen – PDF zu Markdown

Das Tool erkennt Überschriften basierend auf Schriftgröße, Aufzählungspunkte aus gängigen Aufzählungszeichen, nummerierte Listen und alphabetische Listen. Fließtext wird als einfache Absätze ausgegeben.

Ja. Die Ausgabe folgt der Standard-CommonMark-Syntax und funktioniert in GitHub-README-Dateien, Jekyll, Hugo, Docusaurus und den meisten statischen Site-Generatoren.

Nein. Gescannte Dokumente haben keine Textebene. Um gescannte PDFs in Markdown zu konvertieren, führen Sie sie zunächst durch das OCR-Tool, um durchsuchbaren Text zu erstellen.

Die Überschriftenerkennung verwendet Schriftgrößen-Heuristiken und funktioniert bei den meisten Dokumenten gut. Komplexe gemischte Layouts erfordern möglicherweise eine leichte manuelle Bearbeitung nach der Konvertierung.

Verwandte PDF-Tools