PDF zu Markdown
Konvertieren Sie PDF-Text mit Strukturerkennung in Markdown.
Drag & drop files here, or click to select
So funktioniert es:
- Extrahiert Textinhalt aus PDF-Seiten
- Erkennt Überschriften anhand von Schriftgröße und -stil
- Identifiziert Aufzählungspunkte und nummerierte Listen
- Erhält die Seitenstruktur mit Trennzeichen
- Fügt Seitenzahlkommentare zur Referenz hinzu
Hinweis: Dieses Tool funktioniert am besten mit PDFs, die auswählbaren Text enthalten. Gescannte PDFs oder Bilder liefern keine sinnvollen Ergebnisse. Die Ergebnisse können je nach ursprünglicher Formatierung und Textanordnung des PDFs variieren.
So konvertieren Sie ein PDF in das Markdown-Format
Laden Sie Ihre PDF-Datei über die Dateiauswahl hoch oder legen Sie sie im Upload-Bereich ab.
Das Tool liest die Textebene jeder Seite und erkennt Überschriften, Listen und Absatzstruktur.
Klicken Sie auf Konvertieren, um das Dokument zu verarbeiten und Markdown-Ausgabe zu erstellen.
Überprüfen Sie das Markdown im Vorschaufeld, kopieren Sie es in die Zwischenablage oder laden Sie die .md-Datei herunter.
Warum PDF mit SonuPDF in Markdown konvertieren?
Strukturbewusste Extraktion
Verwendet Schriftgröße und Textposition, um automatisch Überschriften (H1, H2, H3), Aufzählungspunkte, nummerierte Listen und Absatzblöcke zu erkennen.
Kopieren oder Herunterladen
Kopieren Sie die Markdown-Ausgabe direkt in Ihre Zwischenablage zur Verwendung in Editoren wie Obsidian, Notion oder GitHub, oder speichern Sie sie als .md-Datei.
Mehrseitige Unterstützung
Jede Seite wird extrahiert und mit horizontalen Trennlinien getrennt, sodass die Struktur langer Dokumente in der Ausgabe erhalten bleibt.
Clientseitiger Datenschutz
Die gesamte Textextraktion erfolgt in Ihrem Browser mit PDF.js. Keine Datei wird auf einen Server hochgeladen, sodass der Inhalt Ihres Dokuments auf Ihrem Gerät bleibt.
Häufig gestellte Fragen – PDF zu Markdown
Das Tool erkennt Überschriften basierend auf Schriftgröße, Aufzählungspunkte aus gängigen Aufzählungszeichen, nummerierte Listen und alphabetische Listen. Fließtext wird als einfache Absätze ausgegeben.
Ja. Die Ausgabe folgt der Standard-CommonMark-Syntax und funktioniert in GitHub-README-Dateien, Jekyll, Hugo, Docusaurus und den meisten statischen Site-Generatoren.
Nein. Gescannte Dokumente haben keine Textebene. Um gescannte PDFs in Markdown zu konvertieren, führen Sie sie zunächst durch das OCR-Tool, um durchsuchbaren Text zu erstellen.
Die Überschriftenerkennung verwendet Schriftgrößen-Heuristiken und funktioniert bei den meisten Dokumenten gut. Komplexe gemischte Layouts erfordern möglicherweise eine leichte manuelle Bearbeitung nach der Konvertierung.
Verwandte PDF-Tools
PDFs zusammenführen
Führen Sie mehrere PDFs sofort in Ihrem Browser zusammen.
PDF teilen
Teilen Sie PDFs nach Seiten oder Bereichen. Schnell, privat, lokal.
PDF drehen
Drehen Sie Seiten und speichern Sie sie ohne Qualitätsverlust.
Wasserzeichen hinzufügen
Fügen Sie Ihrem PDF lokal ein Text-Wasserzeichen hinzu.