PDF a Markdown
Convertiu text del PDF a Markdown amb detecció d'estructura.
Drag & drop files here, or click to select
Com funciona:
- Extreu el contingut de text de les pàgines del PDF
- Detecta capçaleres segons la mida i l'estil de la lletra
- Identifica punts i llistes numerades
- Conserva l'estructura de la pàgina amb separadors
- Afegeix comentaris amb el número de pàgina com a referència
Nota: Aquesta eina funciona millor amb PDF que contenen text seleccionable. Els PDF escanejats o les imatges no produiran resultats significatius. Els resultats poden variar segons el format i l'estructura original del text del PDF.
Com convertir un PDF a format Markdown
Pugeu el vostre fitxer PDF utilitzant el selector de fitxers o deixant-lo anar a l'àrea de pujada.
L'eina llegeix la capa de text de cada pàgina i detecta capçaleres, llistes i estructura de paràgrafs.
Feu clic a Convertir per processar el document i generar la sortida Markdown.
Reviseu el Markdown al quadre de previsualització, copieu-lo al porta-retalls o descarregueu el fitxer .md.
Per què convertir PDF a Markdown amb SonuPDF?
Extracció conscient de l'estructura
Utilitza la mida de la lletra i la posició del text per detectar automàticament capçaleres (H1, H2, H3), punts, llistes numerades i blocs de paràgraf.
Copiar o descarregar
Copieu el resultat Markdown directament al vostre porta-retalls per utilitzar-lo en editors com Obsidian, Notion o GitHub, o deseu-lo com a fitxer .md.
Compatibilitat multipàgina
Cada pàgina s'extreu i se separa amb divisors de línia horitzontal per conservar l'estructura de documents llargs a la sortida.
Privadesa del costat del client
Tota l'extracció de text s'executa al vostre navegador amb PDF.js. No es puja cap fitxer a un servidor, així que el contingut del vostre document es manté a la vostra màquina.
Preguntes freqüents – PDF a Markdown
L'eina detecta capçaleres segons la mida de la lletra, punts a partir de caràcters de vinyeta habituals, llistes numerades i llistes lletrejades. El text del cos es genera com a paràgrafs simples.
Sí. La sortida segueix la sintaxi estàndard CommonMark i funciona en fitxers README de GitHub, Jekyll, Hugo, Docusaurus i la majoria de generadors de llocs estàtics.
No. Els documents escanejats no tenen una capa de text. Per convertir PDF escanejats a Markdown, primer passeu-los per l'eina OCR per generar text cercable.
La detecció de capçaleres utilitza heurístiques de mida de lletra i funciona bé a la majoria de documents. Les disposicions mixtes complexes poden requerir una lleugera edició manual després de la conversió.