SonuPDF

PDF a Markdown

Convertiu text del PDF a Markdown amb detecció d'estructura.

Drag & drop files here, or click to select

Com funciona:

  • Extreu el contingut de text de les pàgines del PDF
  • Detecta capçaleres segons la mida i l'estil de la lletra
  • Identifica punts i llistes numerades
  • Conserva l'estructura de la pàgina amb separadors
  • Afegeix comentaris amb el número de pàgina com a referència

Nota: Aquesta eina funciona millor amb PDF que contenen text seleccionable. Els PDF escanejats o les imatges no produiran resultats significatius. Els resultats poden variar segons el format i l'estructura original del text del PDF.

Com convertir un PDF a format Markdown

1

Pugeu el vostre fitxer PDF utilitzant el selector de fitxers o deixant-lo anar a l'àrea de pujada.

2

L'eina llegeix la capa de text de cada pàgina i detecta capçaleres, llistes i estructura de paràgrafs.

3

Feu clic a Convertir per processar el document i generar la sortida Markdown.

4

Reviseu el Markdown al quadre de previsualització, copieu-lo al porta-retalls o descarregueu el fitxer .md.

Per què convertir PDF a Markdown amb SonuPDF?

file-text

Extracció conscient de l'estructura

Utilitza la mida de la lletra i la posició del text per detectar automàticament capçaleres (H1, H2, H3), punts, llistes numerades i blocs de paràgraf.

clipboard

Copiar o descarregar

Copieu el resultat Markdown directament al vostre porta-retalls per utilitzar-lo en editors com Obsidian, Notion o GitHub, o deseu-lo com a fitxer .md.

layers

Compatibilitat multipàgina

Cada pàgina s'extreu i se separa amb divisors de línia horitzontal per conservar l'estructura de documents llargs a la sortida.

lock

Privadesa del costat del client

Tota l'extracció de text s'executa al vostre navegador amb PDF.js. No es puja cap fitxer a un servidor, així que el contingut del vostre document es manté a la vostra màquina.

Preguntes freqüents – PDF a Markdown

L'eina detecta capçaleres segons la mida de la lletra, punts a partir de caràcters de vinyeta habituals, llistes numerades i llistes lletrejades. El text del cos es genera com a paràgrafs simples.

Sí. La sortida segueix la sintaxi estàndard CommonMark i funciona en fitxers README de GitHub, Jekyll, Hugo, Docusaurus i la majoria de generadors de llocs estàtics.

No. Els documents escanejats no tenen una capa de text. Per convertir PDF escanejats a Markdown, primer passeu-los per l'eina OCR per generar text cercable.

La detecció de capçaleres utilitza heurístiques de mida de lletra i funciona bé a la majoria de documents. Les disposicions mixtes complexes poden requerir una lleugera edició manual després de la conversió.

Eines PDF relacionades