PDF से Markdown
PDF टेक्स्ट को Markdown फ़ॉर्मेट में बदलें।
Drag & drop files here, or click to select
यह कैसे काम करता है:
- PDF पृष्ठों से पाठ सामग्री निकालता है
- फ़ॉन्ट आकार और शैली के आधार पर हेडर का पता लगाता है
- बुलेट पॉइंट और क्रमांकित सूचियों की पहचान करता है
- विभाजक के साथ पृष्ठ संरचना को संरक्षित करता है
- संदर्भ के लिए पृष्ठ संख्या टिप्पणियों को जोड़ता है
नोट: यह टूल उन PDF के साथ सबसे अच्छा काम करता है जिनमें चयन करने योग्य पाठ होता है। स्कैन किए गए PDF या चित्र सार्थक परिणाम नहीं देंगे। परिणाम PDF के मूल स्वरूपण और पाठ लेआउट पर निर्भर कर सकते हैं।
PDF को Markdown फ़ॉर्मेट में कैसे बदलें
फ़ाइल पिकर का उपयोग करके या अपलोड क्षेत्र में खींचकर अपना PDF फ़ाइल अपलोड करें।
टूल प्रत्येक पेज की टेक्स्ट लेयर पढ़ता है और शीर्षकों, सूचियों और पैराग्राफ संरचना का पता लगाता है।
दस्तावेज़ प्रोसेस करने और Markdown आउटपुट जनरेट करने के लिए Convert पर क्लिक करें।
पूर्वावलोकन बॉक्स में Markdown की समीक्षा करें, इसे क्लिपबोर्ड पर कॉपी करें, या .md फ़ाइल डाउनलोड करें।
SonuPDF से PDF को Markdown में क्यों बदलें?
संरचना-जागरुक निष्कर्षण
शीर्षकों (H1, H2, H3), बुलेट पॉइंट, नंबरेड सूचियों और पैराग्राफ ब्लॉक को स्वचालित रूप से पहचानने के लिए फ़ॉन्ट आकार और टेक्स्ट स्थिति का उपयोग करता है।
कॉपी या डाउनलोड
Obsidian, Notion, या GitHub जैसे संपादकों में उपयोग के लिए Markdown आउटपुट सीधे क्लिपबोर्ड पर कॉपी करें, या इसे .md फ़ाइल के रूप में सहेजें।
बहु-पेज समर्थन
प्रत्येक पेज निकाला आता है और क्षैतिज नियम विभाजकों के साथ अलग किया जाता है ताकि लंबे दस्तावेज़ों की संरचना आउटपुट में सुरक्षित रहे।
क्लाइंट-साइड गोपनीयता
सभी टेक्स्ट निष्कर्षण PDF.js के साथ आपके ब्राउज़र में चलता है। कोई भी फ़ाइल सर्वर पर अपलोड नहीं होती, इसलिए आपके दस्तावेज़ की सामग्री आपकी मशीन पर रहती है।
अक्सर पूछे जाने वाले प्रश्न – PDF से Markdown
टूल फ़ॉन्ट आकार के आधार पर शीर्षक, सामान्य बुलेट अक्षरों से बुलेट पॉइंट, नंबरेड सूचियां और अक्षरित सूचियां पहचानता है। मुख्य टेक्स्ट सादे पैराग्राफ के रूप में निर्यात होता है।
हाँ। आउटपुट स्टैंडर्ड CommonMark सिंटैक्स का अनुसरण करता है और GitHub README फ़ाइलों, Jekyll, Hugo, Docusaurus और अधिकांश स्टेटिक साइट जनरेटर में काम करता है।
नहीं। स्कैन किए गए दस्तावेज़ों में टेक्स्ट लेयर नहीं होता। स्कैन किए गए PDF को Markdown में बदलने के लिए, पहले OCR टूल से चलाएं।
शीर्षक पहचान फ़ॉन्ट आकार ह्यूरिस्टिक्स का उपयोग करती है और अधिकांश दस्तावेज़ों पर अच्छी तरह काम करती है। जटिल मिश्र लेआउट को रूपांतरण के बाद हल्के संपादन की आवश्यकता हो सकती है।