SonuPDF

PDF से Markdown

PDF टेक्स्ट को Markdown फ़ॉर्मेट में बदलें।

Drag & drop files here, or click to select

यह कैसे काम करता है:

  • PDF पृष्ठों से पाठ सामग्री निकालता है
  • फ़ॉन्ट आकार और शैली के आधार पर हेडर का पता लगाता है
  • बुलेट पॉइंट और क्रमांकित सूचियों की पहचान करता है
  • विभाजक के साथ पृष्ठ संरचना को संरक्षित करता है
  • संदर्भ के लिए पृष्ठ संख्या टिप्पणियों को जोड़ता है

नोट: यह टूल उन PDF के साथ सबसे अच्छा काम करता है जिनमें चयन करने योग्य पाठ होता है। स्कैन किए गए PDF या चित्र सार्थक परिणाम नहीं देंगे। परिणाम PDF के मूल स्वरूपण और पाठ लेआउट पर निर्भर कर सकते हैं।

PDF को Markdown फ़ॉर्मेट में कैसे बदलें

1

फ़ाइल पिकर का उपयोग करके या अपलोड क्षेत्र में खींचकर अपना PDF फ़ाइल अपलोड करें।

2

टूल प्रत्येक पेज की टेक्स्ट लेयर पढ़ता है और शीर्षकों, सूचियों और पैराग्राफ संरचना का पता लगाता है।

3

दस्तावेज़ प्रोसेस करने और Markdown आउटपुट जनरेट करने के लिए Convert पर क्लिक करें।

4

पूर्वावलोकन बॉक्स में Markdown की समीक्षा करें, इसे क्लिपबोर्ड पर कॉपी करें, या .md फ़ाइल डाउनलोड करें।

SonuPDF से PDF को Markdown में क्यों बदलें?

file-text

संरचना-जागरुक निष्कर्षण

शीर्षकों (H1, H2, H3), बुलेट पॉइंट, नंबरेड सूचियों और पैराग्राफ ब्लॉक को स्वचालित रूप से पहचानने के लिए फ़ॉन्ट आकार और टेक्स्ट स्थिति का उपयोग करता है।

clipboard

कॉपी या डाउनलोड

Obsidian, Notion, या GitHub जैसे संपादकों में उपयोग के लिए Markdown आउटपुट सीधे क्लिपबोर्ड पर कॉपी करें, या इसे .md फ़ाइल के रूप में सहेजें।

layers

बहु-पेज समर्थन

प्रत्येक पेज निकाला आता है और क्षैतिज नियम विभाजकों के साथ अलग किया जाता है ताकि लंबे दस्तावेज़ों की संरचना आउटपुट में सुरक्षित रहे।

lock

क्लाइंट-साइड गोपनीयता

सभी टेक्स्ट निष्कर्षण PDF.js के साथ आपके ब्राउज़र में चलता है। कोई भी फ़ाइल सर्वर पर अपलोड नहीं होती, इसलिए आपके दस्तावेज़ की सामग्री आपकी मशीन पर रहती है।

अक्सर पूछे जाने वाले प्रश्न – PDF से Markdown

टूल फ़ॉन्ट आकार के आधार पर शीर्षक, सामान्य बुलेट अक्षरों से बुलेट पॉइंट, नंबरेड सूचियां और अक्षरित सूचियां पहचानता है। मुख्य टेक्स्ट सादे पैराग्राफ के रूप में निर्यात होता है।

हाँ। आउटपुट स्टैंडर्ड CommonMark सिंटैक्स का अनुसरण करता है और GitHub README फ़ाइलों, Jekyll, Hugo, Docusaurus और अधिकांश स्टेटिक साइट जनरेटर में काम करता है।

नहीं। स्कैन किए गए दस्तावेज़ों में टेक्स्ट लेयर नहीं होता। स्कैन किए गए PDF को Markdown में बदलने के लिए, पहले OCR टूल से चलाएं।

शीर्षक पहचान फ़ॉन्ट आकार ह्यूरिस्टिक्स का उपयोग करती है और अधिकांश दस्तावेज़ों पर अच्छी तरह काम करती है। जटिल मिश्र लेआउट को रूपांतरण के बाद हल्के संपादन की आवश्यकता हो सकती है।

संबंधित पीडीएफ टूल्स