PDF OCR

ऑप्टिकल कैरेक्टर रिकग्निशन (OCR) से स्कैन की गई PDF से टेक्स्ट निकालें।

PDF फ़ाइल खींचकर छोड़ें, या चुनने के लिए क्लिक करें

PDF फ़ाइलें समर्थित हैं

उपयोग के उदाहरण

स्कैन किए कागज़ी दस्तावेज़ से टेक्स्ट निकालना

स्कैनर या फ़ोटो से कागज़ी दस्तावेज़ को PDF बनाने के बाद, उसके अंदर के अक्षर पहचानकर कॉपी व एडिट करने लायक टेक्स्ट में बदलें।

बिना टेक्स्ट लेयर वाली PDF पढ़ना

सिर्फ़ इमेज से बनी PDF, जिन्हें सामान्य PDF-टू-टेक्स्ट टूल नहीं पढ़ सकता, उनसे भी OCR से कंटेंट निकाला जा सकता है।

किसी खास भाषा के दस्तावेज़ को पहचानना

अंग्रेज़ी, कोरियाई, जापानी जैसी सही भाषा चुनकर उस भाषा के दस्तावेज़ की पहचान सटीकता बढ़ाएँ।

अक्सर पूछे जाने वाले सवाल

क्या अपलोड की गई PDF सर्वर पर भेजी जाती है?

नहीं। PDF को इमेज में बदलना और टेक्स्ट पहचानना, दोनों पूरी तरह आपके ब्राउज़र में होते हैं, और अपलोड की गई PDF या उसका कंटेंट कभी सर्वर पर नहीं भेजा जाता। बस एक अपवाद है: चुनी गई भाषा की पहचान मॉडल फ़ाइल पहली बार इस्तेमाल पर एक सार्वजनिक CDN से डाउनलोड होती है — यह सिर्फ़ एक सामान्य प्रोग्राम फ़ाइल है, आपके दस्तावेज़ के कंटेंट से इसका कोई लेना-देना नहीं।

क्या इसे पहले से टेक्स्ट वाली सामान्य PDF पर इस्तेमाल कर सकते हैं?

कर सकते हैं, लेकिन अगर PDF में पहले से टेक्स्ट लेयर है, तो हमारा PDF-टू-टेक्स्ट टूल ज़्यादा तेज़ और सटीक रहेगा। OCR स्कैन किए दस्तावेज़ों जैसी सिर्फ़ इमेज वाली PDF के लिए बनाया गया है।

पहचान कितनी सटीक होती है?

यह स्कैन क्वालिटी, फ़ॉन्ट और स्पष्टता पर निर्भर करता है। हाई-रिज़ॉल्यूशन, साफ़ दस्तावेज़ ज़्यादा सटीकता से पहचाने जाते हैं, जबकि हाथ से लिखा या धुंधला स्कैन कम सटीक हो सकता है।

ज़्यादा पेज वाली PDF में कितना समय लगता है?

पेज एक-एक करके पहचाने जाते हैं, इसलिए समय पेजों की संख्या के हिसाब से बढ़ता है। अगर ज़्यादा समय लग रहा हो तो प्रोसेसिंग के दौरान कभी भी रद्द करें बटन से रोक सकते हैं।