टेक्स्ट पहचान (OCR)
आपके स्कैन टेक्स्ट बन जाते हैं — विश्लेषण आपकी ही मशीन पर होता है।
आपकी फ़ाइलें आपके डिवाइस से कभी बाहर नहीं जातींPDF या इमेज यहाँ छोड़ें
स्कैन की हुई PDF या फ़ोटो — JPG, PNG
स्कैन की हुई PDF का टेक्स्ट कैसे पहचानें, चरण-दर-चरण
OCR किसी स्कैन को इस्तेमाल योग्य टेक्स्ट में बदलता है, एक पहचान इंजन को सीधे आपके ब्राउज़र में लोड करके: दस्तावेज़ कभी ऑनलाइन नहीं जाता।
स्कैन की हुई PDF या फ़ोटो छोड़ें
कोई PDF या JPG/PNG इमेज छोड़ने वाले क्षेत्र में खींचें, या उसे ब्राउज़ करने के लिए क्लिक करें।
दस्तावेज़ की भाषा चुनें
उसे “दस्तावेज़ की भाषा” में चुनें: साइट की भाषाएँ सबसे ऊपर, फिर सौ से ज़्यादा और, जिनका मॉडल पहली बार इस्तेमाल पर डाउनलोड होता है। अगर चुनी हुई भाषा असली टेक्स्ट से मेल न खाए तो पहचान काफ़ी कम भरोसेमंद होती है; “दूसरी भाषा” द्विभाषी दस्तावेज़ों के लिए है।
अगर फ़ाइल PDF है तो पृष्ठ-सीमा तय करें
फ़ील्ड “1-3, 5, 8-10” जैसी सीमा स्वीकार करता है; खाली छोड़ने पर सभी पृष्ठों का विश्लेषण होता है।
“पहचान शुरू करें” पर क्लिक करें
पहचान इंजन (लगभग 4 MB) भाषा के मॉडल के साथ हमारे सर्वरों से एक ही बार डाउनलोड होता है; जो भाषा शामिल नहीं है उसके लिए, शुरू करने से पहले मॉडल का आकार बताया जाता है। विश्लेषण खुद उसके बाद पूरी तरह आपके डिवाइस पर होता है।
नतीजा और उसका भरोसे का स्तर पढ़ें
पहचाना गया टेक्स्ट शब्दों की संख्या और औसत भरोसे के साथ दिखता है; कम भरोसा संकेत देता है कि स्कैन शायद तिरछा या खराब गुणवत्ता का है।
टेक्स्ट या खोजने योग्य PDF डाउनलोड करें
.txt फ़ाइल में सादा टेक्स्ट होता है; खोजने योग्य PDF मूल लेआउट बनाए रखती है और उसके ऊपर एक अदृश्य टेक्स्ट परत रखती है, जो दस्तावेज़ को चुनने योग्य और कीवर्ड से खोजने योग्य बनाती है।
खोजने योग्य PDF में, स्कैन किया हुआ पृष्ठ अपनी मूल इमेज रखता है और सभी लिपियों के लिए मान्य एक अदृश्य टेक्स्ट परत पाता है, ग्रीक, सिरिलिक, अरबी या चीनी समेत; जिस पृष्ठ में पहले से टेक्स्ट था, उसे इमेज के रूप में दोबारा बनाया जाता है ताकि उस पर दो परतें न हों।
अक्सर पूछे जाने वाले प्रश्न
क्या VellumPDF का OCR PDF और फ़ोटो दोनों स्वीकार करता है?
हाँ, आप स्कैन की गई PDF या सीधे JPG या PNG फ़ॉर्मैट की इमेज छोड़ सकते हैं। दोनों मामलों में टूल एक खोजने योग्य PDF बनाता है जिसका टेक्स्ट चुना और कॉपी किया जा सकता है।
टेक्स्ट की पहचान किन भाषाओं में काम करती है?
सौ से ज़्यादा भाषाओं में। साइट की भाषाएँ शामिल हैं और VellumPDF खुद उन्हें परोसता है; बाकी (चेक, यूनानी, हिब्रू, फ़ारसी…) इसी “दस्तावेज़ की भाषा” सूची में चुनी जाती हैं, और उनका मॉडल पहली बार इस्तेमाल पर एक बार डाउनलोड होता है। “दूसरी भाषा” द्विभाषी दस्तावेज़ को संभालती है। सही भाषा चुनने से नतीजे की विश्वसनीयता साफ़ बढ़ती है।
क्या मेरा स्कैन किया दस्तावेज़ किसी ऑनलाइन आर्टिफ़िशियल इंटेलिजेंस सेवा को भेजा जाता है?
नहीं। पहचान का इंजन आपके ब्राउज़र में चलता है। साइट की भाषाओं के लिए उसकी फ़ाइलें VellumPDF के डोमेन से आती हैं; किसी दूसरी भाषा के लिए सिर्फ़ उसका मॉडल raw.githubusercontent.com से, यानी Tesseract प्रोजेक्ट के सार्वजनिक रिपॉज़िटरी से, स्क्रीन पर सूचना के बाद डाउनलोड होता है। यह डाउनलोड एक ही दिशा में जाता है: दस्तावेज़ आपका डिवाइस नहीं छोड़ता और किसी आर्टिफ़िशियल इंटेलिजेंस सेवा को नहीं बुलाया जाता।
क्या पहचान का मॉडल हर इस्तेमाल पर डाउनलोड होता है, और उसका वज़न कितना है?
हर भाषा का अपना मॉडल है। VellumPDF द्वारा परोसी जाने वाली साइट की भाषाओं के लिए: भाषा के अनुसार कंप्रेस होकर 0,4 से 3 MB (फ़्रेंच के लिए लगभग 700 KB, अंग्रेज़ी के लिए क़रीब 3 MB); ब्राउज़र की सामान्य कैश उन्हें दोबारा डाउनलोड होने से बचाती है। दूसरी भाषाओं के लिए भाषा के अनुसार 0,4 से 12 MB, जिसका वज़न शुरू करने से पहले दिखता है; एक बार डाउनलोड होने पर मॉडल ब्राउज़र में रहता है और दूसरी बार कुछ डाउनलोड नहीं होता।
कैसे जानें कि नतीजा भरोसेमंद है, जैसे टेढ़े या ख़राब स्कैन पर?
नतीजे के साथ पहचाने गए सारे शब्दों पर निकाला औसत विश्वास प्रतिशत दिखता है। 70 % से नीचे एक चेतावनी बताती है कि पहचान अनिश्चित है और स्कैन शायद तिरछा या कम गुणवत्ता का है — यह संकेत है कि मिले टेक्स्ट पर भरोसा करने के बजाय स्कैन दोबारा करें।
अगर मैं पासवर्ड से सुरक्षित PDF छोड़ूँ तो क्या होता है?
पहचान शुरू में ही मना हो जाती है, एक संदेश के साथ जो बताता है कि एन्क्रिप्टेड PDF पर OCR नहीं हो सकता। यहाँ छोड़ने से पहले दस्तावेज़ की सुरक्षा हटानी होगी।
क्या कई दस्तावेज़ों का OCR एक साथ हो सकता है?
नहीं, टूल एक बार में एक फ़ाइल संसाधित करता है — एक स्कैन की गई PDF या एक इमेज। कई दस्तावेज़ों के लिए क्रिया हर एक पर दोहरानी होगी।