मुख्य सामग्री पर जाएँ

PDF से टेक्स्ट

आपकी PDF की सामग्री, दोबारा इस्तेमाल करने योग्य सादे टेक्स्ट में।

आपकी फ़ाइलें आपके डिवाइस से कभी बाहर नहीं जातीं

अपनी PDF यहाँ छोड़ें

फ़ाइल डालते ही टेक्स्ट अपने आप निकाल लिया जाता है

PDF से टेक्स्ट कैसे निकालें, चरण-दर-चरण

टूल फ़ाइल में असल में मौजूद टेक्स्ट को पृष्ठ-दर-पृष्ठ निकालता है, उसे दोबारा पढ़ने या कहीं और इस्तेमाल करने के लिए। आपके ब्राउज़र के बाहर कुछ भी नहीं भेजा जाता।

  1. PDF छोड़ें

    फ़ाइल को छोड़ने वाले क्षेत्र में खींचें, या अपनी फ़ाइलें ब्राउज़ करने के लिए क्लिक करें। निकालना तुरंत शुरू हो जाता है, किसी बटन पर क्लिक किए बिना।

  2. VellumPDF को हर पृष्ठ देखने दें

    हर पृष्ठ का टेक्स्ट निकाला जाता है, फिर अगले से एक “———— पृष्ठ n ————” चिह्न से जोड़ा जाता है, उसी क्रम में जिसमें वह फ़ाइल में आता है।

  3. दिखाया गया नतीजा दोबारा पढ़ें

    पूरा टेक्स्ट एक स्क्रॉल होने वाले फ़्रेम में दिखता है, ठीक ऊपर अक्षरों और शब्दों की संख्या के साथ।

  4. टेक्स्ट डाउनलोड या कॉपी करें

    “.txt डाउनलोड करें” मूल PDF के नाम वाली एक टेक्स्ट फ़ाइल सहेजता है; “कॉपी करें” नतीजे को क्लिपबोर्ड में रखता है ताकि उसे कहीं और पेस्ट किया जा सके।

पासवर्ड से सुरक्षित PDF को शुरू में ही एक अलग संदेश के साथ अस्वीकार कर दिया जाता है: यहाँ लौटने से पहले अनलॉक टूल से सुरक्षा हटानी होगी।

अक्सर पूछे जाने वाले प्रश्न

PDF से निकाला गया टेक्स्ट कैसा दिखता है?

टेक्स्ट एक .txt फ़ाइल में मिलता है, पृष्ठ-दर-पृष्ठ व्यवस्थित, जिसे वर्ड प्रोसेसर या किसी भी दूसरे टूल में दोबारा इस्तेमाल किया जा सकता है। फ़ाइल में असल में मौजूद टेक्स्ट ही उठाया जाता है, बिना फ़ॉर्मैटिंग के।

क्या टूल स्कैन की गई PDF पर काम करता है?

नहीं, निकालना सिर्फ़ PDF फ़ाइल में पहले से मौजूद टेक्स्ट पर टिका है, इमेज की पहचान पर नहीं। अगर दस्तावेज़ ऐसा स्कैन है जिसके नीचे कोई टेक्स्ट नहीं, तो कुछ भी बाहर नहीं आएगा: पहले उसे VellumPDF के OCR टूल से गुज़ारें।

क्या यह सेवा मुफ़्त है और क्या दस्तावेज़ ऑनलाइन भेजा जाता है?

हाँ, टूल मुफ़्त है और उपयोग की सीमा के बिना। निकालना पूरी तरह आपके ब्राउज़र में होता है, PDF किसी सर्वर को भेजे बिना।

क्या निकाला गया टेक्स्ट पृष्ठ का लेआउट रखता है?

नहीं, और यह इस फ़ॉर्मैट की प्रकृति है: आपको टेक्स्ट मिलता है, लेआउट नहीं। स्तंभ एक के बाद एक खुलते जाते हैं, तालिकाएँ अपनी ग्रिड खो देती हैं। अगर संरचना मायने रखती है तो Markdown में एक्सपोर्ट कम-से-कम शीर्षक बचाकर रखता है; अगर लेआउट मायने रखता है तो Word में एक्सपोर्ट चाहिए।

दो स्तंभों वाले पृष्ठ से टेक्स्ट किस क्रम में निकलता है?

उसी क्रम में जिसमें वह फ़ाइल में घोषित है, जो आम तौर पर स्वाभाविक पढ़ाई का पालन करता है पर हमेशा नहीं। किसी ब्रोशर या अख़बार में कभी कोई बॉक्स किसी अनुच्छेद के बीच में आ जाता है। एक तेज़ दोबारा पढ़ाई से यह पकड़ में आ जाता है।

कुछ फ़ाइलों पर निकालना कुछ क्यों नहीं देता?

क्योंकि दस्तावेज़ में टेक्स्ट की परत नहीं है: वह पृष्ठ की इमेज है, आम तौर पर स्कैन या फ़ोटो। तब निकालने को सचमुच कुछ नहीं होता। पहले फ़ाइल को अक्षर पहचान से गुज़ारें, जो यह परत जोड़ती है, फिर निकालना दोबारा चलाएँ।