मुख्य सामग्री पर जाएं
PDFHome

PDF OCR – मुफ्त और निजी

स्कैन किए गए दस्तावेज़ को खोजने योग्य, चयन योग्य पीडीएफ में बदलें। पृष्ठ अभी भी बिल्कुल वैसा ही दिखता है - अब आप इसके पाठ को खोज, चयन और कॉपी कर सकते हैं।

PDF फ़ाइलें यहाँ खींचें और छोड़ें

या अपने डिवाइस से फ़ाइलें चुनें

फ़ाइलें आपके ब्राउज़र में लोकल रूप से संसाधित होती हैं — कुछ भी अपलोड नहीं होता

यह कैसे काम करता है

1

अपनी स्कैन की हुई पीडीएफ अपलोड करें

एक पीडीएफ फ़ाइल को ऊपर दिए गए बॉक्स में खींचें और छोड़ें, या अपने डिवाइस को ब्राउज़ करने के लिए क्लिक करें।

2

OCR स्वचालित रूप से चलता है

प्रत्येक पृष्ठ का विश्लेषण किया जाता है और उसके पाठ को सीधे आपके ब्राउज़र में पहचाना जाता है - इसमें लंबे दस्तावेज़ों के लिए थोड़ा समय लग सकता है।

3

खोजने योग्य पीडीएफ डाउनलोड करें

आपकी फ़ाइल समान दिखती है, लेकिन इसका पाठ अब चयन योग्य, खोजने योग्य और प्रतिलिपि बनाने योग्य है।

PDFHome क्यों चुनें?

आपका दस्तावेज़ निजी रहता है

टेक्स्ट पहचान पूरी तरह से आपके ब्राउज़र में WebAssembly का उपयोग करके चलती है - आपका पीडीएफ कभी भी कहीं भी अपलोड नहीं किया जाता है। (पहला रन सीडीएन से एक छोटी अंग्रेजी भाषा की डेटा फ़ाइल डाउनलोड करता है।)

मूल स्वरूप बरकरार रखता है

दृश्यमान पृष्ठ अछूता है - OCR शीर्ष पर केवल एक अदृश्य, खोजने योग्य पाठ परत जोड़ता है।

टेक्स्ट खोजें और चुनें

एक बार संसाधित होने के बाद, आप पीडीएफ के भीतर खोज सकते हैं, टेक्स्ट का चयन और प्रतिलिपि बना सकते हैं, और उस पर स्क्रीन रीडर का उपयोग कर सकते हैं।

किसी भी डिवाइस पर काम करता है

PDFHome डेस्कटॉप, टैबलेट या मोबाइल पर किसी भी आधुनिक ब्राउज़र में चलता है।

नि:शुल्क, किसी खाते की आवश्यकता नहीं

ओसीआर पीडीएफ बिना किसी साइन-अप के पूरी तरह से मुफ़्त है।

अक्सर पूछे जाने वाले प्रश्न

ओसीआर (ऑप्टिकल कैरेक्टर रिकॉग्निशन) पाठ की एक छवि का विश्लेषण करता है और उसमें वास्तविक अक्षरों और शब्दों को पहचानता है, इसलिए सॉफ्टवेयर जो सिर्फ एक तस्वीर थी उसे वास्तविक, खोजने योग्य पाठ के रूप में मान सकता है।

नहीं - दृश्यमान पृष्ठ छ���ि बिल्कुल वैसी ही छोड़ दी गई है जैसी वह थी। ओसीआर शीर्ष पर एक अदृश्य पाठ परत जोड़ता है ताकि सामग्री बिना किसी दृश्य परिवर्तन के चयन योग्य और खोजने योग्य हो जाए।

सटीकता काफी हद तक स्कैन की गुणवत्ता पर निर्भर करती है - मुद्रित पाठ के साफ, अच्छी रोशनी वाले, उच्च-रिज़ॉल्यूशन वाले स��कैन बहुत अच्छी तरह से पहचानते हैं, जबकि लिखावट, तिरछे पृष्ठों या कम-रिज़ॉल्यूशन वाली छवियों में अधिक त्रुटियां होंगी।

पाठ पहचान कम्प्यूटेशनल रूप से गहन है और पूरी तरह से आपके डिवाइस पर चलती है - लंबे दस्तावेज़ और उच्च पृष्ठ संख्या आनुपातिक रूप से अधिक समय लेती है, क्योंकि समानांतर में कोई सर्वर काम नहीं कर रहा है।

हाँ। पूरी प्रक्रिया - पृष्ठों को प्रस्तुत करना और पाठ को पहचानना - आपके ब्राउज़र में आपके अपने डिवाइस पर होता है।

वर्तमान टूल अंग्रेजी पाठ को पहचानता है। भविष्य के अद्यतन के लिए अतिरिक्त भाषाओं के लिए समर्थन की योजना बनाई गई है।