PDF से Markdown
आपकी PDF एक व्यवस्थित टेक्स्ट बन जाती है, Markdown एडिटर के लिए तैयार।
आपकी फ़ाइलें आपके डिवाइस से कभी बाहर नहीं जातींअपनी PDF यहाँ छोड़ें
फ़ाइल डालते ही रूपांतरण अपने आप शुरू हो जाता है
PDF को Markdown में कैसे बदलें, चरण-दर-चरण
PDF का टेक्स्ट उसके दृश्य फ़ॉर्मेट — फ़ॉन्ट के आकार, बुलेट वाली या क्रमांकित सूचियाँ — से सीधे आपके ब्राउज़र में Markdown के रूप में दोबारा बनाया जाता है।
PDF छोड़ें
फ़ाइल को छोड़ने वाले क्षेत्र में खींचें, या अपनी फ़ाइलें ब्राउज़ करने के लिए क्लिक करें। रूपांतरण अपने आप शुरू हो जाता है, पृष्ठ-दर-पृष्ठ।
प्रगति देखें
एक संदेश उस पृष्ठ को बताता है जिसकी प्रोसेसिंग चल रही है (“पृष्ठ n / कुल”), जबकि VellumPDF टेक्स्ट को शीर्षकों, सूचियों और अनुच्छेदों में समूहित करता है।
चुनें कि पृष्ठ अलग किए जाएँ या नहीं
“पृष्ठों को --- वाली पंक्ति से अलग करें” वाला खाना, जो डिफ़ॉल्ट रूप से चुना रहता है, हर पृष्ठ के बीच एक विभाजक पंक्ति डालता है; बिना पृष्ठ-चिह्न वाले लगातार दस्तावेज़ के लिए उसे हटा दें।
दिखाया गया Markdown दोबारा पढ़ें
नतीजा एक स्क्रॉल होने वाले फ़्रेम में दिखता है, ठीक ऊपर अक्षरों की संख्या के साथ।
नतीजा डाउनलोड या कॉपी करें
“.md डाउनलोड करें” एक Markdown फ़ाइल सहेजता है; “कॉपी करें” उसे क्लिपबोर्ड में रखता है।
सादे टेक्स्ट निकालने की तरह, पासवर्ड से सुरक्षित PDF को शुरू में ही अस्वीकार कर दिया जाता है: पहले अनलॉक टूल से सुरक्षा हटाएँ।
अक्सर पूछे जाने वाले प्रश्न
VellumPDF Markdown फ़ाइल में शीर्षक कैसे तय करता है?
टूल PDF के फ़ॉन्ट आकार जाँचकर दृश्य पदानुक्रम पहचानता है और उससे स्तर 1, 2 या 3 के शीर्षक निकालता है। जिस दस्तावेज़ में साफ़ टाइपोग्राफ़िक पदानुक्रम नहीं, वहाँ नतीजा सपाट टेक्स्ट ही रहता है।
क्या तालिकाएँ और स्तंभों वाले लेआउट बचे रहते हैं?
नहीं, तालिकाएँ Markdown में दोबारा नहीं बनाई जातीं और कई स्तंभों वाला लेआउट अनपेक्षित क्रम में पढ़ा जा सकता है, क्योंकि विश्लेषण पंक्ति-दर-पंक्ति होता है, पृष्ठ के क्षेत्रों के अनुसार नहीं। नतीजा सादे टेक्स्ट-प्रवाह वाले दस्तावेज़ के लिए ज़्यादा ठीक है।
अगर मेरी PDF स्कैन किया हुआ दस्तावेज़ हो तो क्या होता है?
अगर कोई टेक्स्ट नहीं निकाला जा सकता तो संभवतः PDF स्कैन से बनी इमेज की है। उसे Markdown में बदलने से पहले VellumPDF के OCR टूल से गुज़ारना होगा। रूपांतरण ख़ुद मुफ़्त है और आपके ब्राउज़र में होता है।
शीर्षक किन संकेतों से पहचाने जाते हैं?
PDF कभी यह घोषित नहीं करती कि “यह शीर्षक है”: इसका अंदाज़ा लगाना पड़ता है। टूल सिर्फ़ एक संकेत पर भरोसा करता है, फ़ॉन्ट का आकार, जिसकी तुलना पूरे दस्तावेज़ में मुख्य पाठ के प्रचलित आकार से होती है। साफ़ तौर पर बड़े आकार (कम-से-कम 15 % ज़्यादा) शीर्षकों के पायदान बनाते हैं: सबसे बड़ा स्तर 1 का शीर्षक बनता है, उसके बाद वाला स्तर 2 का, बाकी सब स्तर 3 के। टूल न मोटाई देखता है, न पृष्ठ पर स्थान, न “अध्याय” या “अनुच्छेद” जैसे शब्द।
क्या मैं सुझाए गए पदानुक्रम को सुधार सकता हूँ?
टूल में नहीं: VellumPDF Markdown एक ही बार में बनाता है, एक्सपोर्ट से पहले छेड़ने के लिए शीर्षकों की कोई सूची नहीं। पहचान एक शुरुआती बिंदु देती है, और सुधार बाद में किसी भी टेक्स्ट एडिटर में होता है — यही इस फ़ॉर्मैट की ख़ूबी है। रूपांतरण फ़ाइल छोड़ते ही अपने आप शुरू होता है; नतीजा तैयार होने पर दिखने वाली एकमात्र सेटिंग वह चेकबॉक्स है जो पृष्ठों के बीच --- वाली एक पंक्ति जोड़ता या हटाता है।
PDF को Markdown में एक्सपोर्ट करने का क्या फ़ायदा है?
टेक्स्ट को ऐसे रूप में पाना जो संरचना बचाए रखता है और हर जगह दोबारा पढ़ा जा सकता है: कोड रिपॉज़िटरी, नोट्स की कॉपी, साइट जनरेटर, भाषा मॉडल। सादे टेक्स्ट एक्सपोर्ट के उलट यहाँ शीर्षक शीर्षक ही रहते हैं, इसलिए दस्तावेज़ की रूपरेखा बची रहती है।