स्कैन की PDF में खोजने लायक टेक्स्ट कैसे जोड़ें
अंग्रेजी स्कैन पर OCR चलाएं और पहचाने गए शब्दों की जांच करें।
कौन सी फाइल चुनें?
15 MB से छोटी और अधिकतम आठ पेज वाली साफ अंग्रेजी स्कैन चुनें। OCR इंजन और अंग्रेजी मॉडल लोड होने दें। काम पूरा होने तक टैब खुला रखें।
टूल क्या करता है?
ब्राउज़र में Tesseract तस्वीर से शब्द पहचानता है और PDF में छिपी टेक्स्ट परत जोड़ता है। डाउनलोड देने से पहले टेक्स्ट निकाला जा सकता है या नहीं, यह जांचता है। इससे शब्दों की शुद्धता साबित नहीं होती।
हिंदी स्कैन की सीमा
मौजूदा टूल साफ छपे अंग्रेजी टेक्स्ट के लिए है। हिंदी, दूसरे अक्षर, हाथ की लिखावट, टेढ़े पेज, मुहर और छोटे अक्षर सही न पहचाने जा सकते हैं। पहले एक पेज आजमाएं।
डाउनलोड के बाद
नाम, खाता नंबर, रकम और तारीख स्कैन से मिलाएं। PDF रीडर में कोई खास वाक्य खोजें और एक लाइन कॉपी करके क्रम तथा विराम चिह्न जांचें। मूल स्कैन संभालकर रखें।
लेखक: Feroz Sheikh