मुख्य सामग्री पर जाएँ

टेक्स्ट पहचान (OCR)

आपके स्कैन टेक्स्ट बन जाते हैं — विश्लेषण आपकी ही मशीन पर होता है।

आपकी फ़ाइलें आपके डिवाइस से कभी बाहर नहीं जातीं

PDF या इमेज यहाँ छोड़ें

स्कैन की हुई PDF या फ़ोटो — JPG, PNG

स्कैन की हुई PDF का टेक्स्ट कैसे पहचानें, चरण-दर-चरण

OCR किसी स्कैन को इस्तेमाल योग्य टेक्स्ट में बदलता है, एक पहचान इंजन को सीधे आपके ब्राउज़र में लोड करके: दस्तावेज़ कभी ऑनलाइन नहीं जाता।

  1. स्कैन की हुई PDF या फ़ोटो छोड़ें

    कोई PDF या JPG/PNG इमेज छोड़ने वाले क्षेत्र में खींचें, या उसे ब्राउज़ करने के लिए क्लिक करें।

  2. दस्तावेज़ की भाषा चुनें

    उसे “दस्तावेज़ की भाषा” में चुनें: साइट की भाषाएँ सबसे ऊपर, फिर सौ से ज़्यादा और, जिनका मॉडल पहली बार इस्तेमाल पर डाउनलोड होता है। अगर चुनी हुई भाषा असली टेक्स्ट से मेल न खाए तो पहचान काफ़ी कम भरोसेमंद होती है; “दूसरी भाषा” द्विभाषी दस्तावेज़ों के लिए है।

  3. अगर फ़ाइल PDF है तो पृष्ठ-सीमा तय करें

    फ़ील्ड “1-3, 5, 8-10” जैसी सीमा स्वीकार करता है; खाली छोड़ने पर सभी पृष्ठों का विश्लेषण होता है।

  4. “पहचान शुरू करें” पर क्लिक करें

    पहचान इंजन (लगभग 4 MB) भाषा के मॉडल के साथ हमारे सर्वरों से एक ही बार डाउनलोड होता है; जो भाषा शामिल नहीं है उसके लिए, शुरू करने से पहले मॉडल का आकार बताया जाता है। विश्लेषण खुद उसके बाद पूरी तरह आपके डिवाइस पर होता है।

  5. नतीजा और उसका भरोसे का स्तर पढ़ें

    पहचाना गया टेक्स्ट शब्दों की संख्या और औसत भरोसे के साथ दिखता है; कम भरोसा संकेत देता है कि स्कैन शायद तिरछा या खराब गुणवत्ता का है।

  6. टेक्स्ट या खोजने योग्य PDF डाउनलोड करें

    .txt फ़ाइल में सादा टेक्स्ट होता है; खोजने योग्य PDF मूल लेआउट बनाए रखती है और उसके ऊपर एक अदृश्य टेक्स्ट परत रखती है, जो दस्तावेज़ को चुनने योग्य और कीवर्ड से खोजने योग्य बनाती है।

खोजने योग्य PDF में, स्कैन किया हुआ पृष्ठ अपनी मूल इमेज रखता है और सभी लिपियों के लिए मान्य एक अदृश्य टेक्स्ट परत पाता है, ग्रीक, सिरिलिक, अरबी या चीनी समेत; जिस पृष्ठ में पहले से टेक्स्ट था, उसे इमेज के रूप में दोबारा बनाया जाता है ताकि उस पर दो परतें न हों।

अक्सर पूछे जाने वाले प्रश्न

क्या VellumPDF का OCR PDF और फ़ोटो दोनों स्वीकार करता है?

हाँ, आप स्कैन की गई PDF या सीधे JPG या PNG फ़ॉर्मैट की इमेज छोड़ सकते हैं। दोनों मामलों में टूल एक खोजने योग्य PDF बनाता है जिसका टेक्स्ट चुना और कॉपी किया जा सकता है।

टेक्स्ट की पहचान किन भाषाओं में काम करती है?

सौ से ज़्यादा भाषाओं में। साइट की भाषाएँ शामिल हैं और VellumPDF खुद उन्हें परोसता है; बाकी (चेक, यूनानी, हिब्रू, फ़ारसी…) इसी “दस्तावेज़ की भाषा” सूची में चुनी जाती हैं, और उनका मॉडल पहली बार इस्तेमाल पर एक बार डाउनलोड होता है। “दूसरी भाषा” द्विभाषी दस्तावेज़ को संभालती है। सही भाषा चुनने से नतीजे की विश्वसनीयता साफ़ बढ़ती है।

क्या मेरा स्कैन किया दस्तावेज़ किसी ऑनलाइन आर्टिफ़िशियल इंटेलिजेंस सेवा को भेजा जाता है?

नहीं। पहचान का इंजन आपके ब्राउज़र में चलता है। साइट की भाषाओं के लिए उसकी फ़ाइलें VellumPDF के डोमेन से आती हैं; किसी दूसरी भाषा के लिए सिर्फ़ उसका मॉडल raw.githubusercontent.com से, यानी Tesseract प्रोजेक्ट के सार्वजनिक रिपॉज़िटरी से, स्क्रीन पर सूचना के बाद डाउनलोड होता है। यह डाउनलोड एक ही दिशा में जाता है: दस्तावेज़ आपका डिवाइस नहीं छोड़ता और किसी आर्टिफ़िशियल इंटेलिजेंस सेवा को नहीं बुलाया जाता।

क्या पहचान का मॉडल हर इस्तेमाल पर डाउनलोड होता है, और उसका वज़न कितना है?

हर भाषा का अपना मॉडल है। VellumPDF द्वारा परोसी जाने वाली साइट की भाषाओं के लिए: भाषा के अनुसार कंप्रेस होकर 0,4 से 3 MB (फ़्रेंच के लिए लगभग 700 KB, अंग्रेज़ी के लिए क़रीब 3 MB); ब्राउज़र की सामान्य कैश उन्हें दोबारा डाउनलोड होने से बचाती है। दूसरी भाषाओं के लिए भाषा के अनुसार 0,4 से 12 MB, जिसका वज़न शुरू करने से पहले दिखता है; एक बार डाउनलोड होने पर मॉडल ब्राउज़र में रहता है और दूसरी बार कुछ डाउनलोड नहीं होता।

कैसे जानें कि नतीजा भरोसेमंद है, जैसे टेढ़े या ख़राब स्कैन पर?

नतीजे के साथ पहचाने गए सारे शब्दों पर निकाला औसत विश्वास प्रतिशत दिखता है। 70 % से नीचे एक चेतावनी बताती है कि पहचान अनिश्चित है और स्कैन शायद तिरछा या कम गुणवत्ता का है — यह संकेत है कि मिले टेक्स्ट पर भरोसा करने के बजाय स्कैन दोबारा करें।

अगर मैं पासवर्ड से सुरक्षित PDF छोड़ूँ तो क्या होता है?

पहचान शुरू में ही मना हो जाती है, एक संदेश के साथ जो बताता है कि एन्क्रिप्टेड PDF पर OCR नहीं हो सकता। यहाँ छोड़ने से पहले दस्तावेज़ की सुरक्षा हटानी होगी।

क्या कई दस्तावेज़ों का OCR एक साथ हो सकता है?

नहीं, टूल एक बार में एक फ़ाइल संसाधित करता है — एक स्कैन की गई PDF या एक इमेज। कई दस्तावेज़ों के लिए क्रिया हर एक पर दोहरानी होगी।