स्कैन का OCR टेक्स्ट में (अंग्रेज़ी)
ऑफ़लाइन OCR से स्कैन की गई PDF से टेक्स्ट निकालें। सिर्फ़ अंग्रेज़ी पहचान, आउटपुट एक साधारण .txt फ़ाइल है — यहां बिल्कुल वही है जो मिलेगा।
1FileTool का OCR टूल स्कैन की गई PDF को आपके Mac पर साधारण टेक्स्ट फ़ाइल में बदल देता है — कोई अपलोड नहीं, कोई क्लाउड OCR सेवा नहीं। यह सिर्फ़ अंग्रेज़ी टेक्स्ट पहचानता है और .txt फ़ाइल लिखता है, searchable PDF नहीं।
पहले अपनी ओरिजिनल फ़ाइलें सुरक्षित करें
Replace source डिफ़ॉल्ट ऑन है: आउटपुट ओरिजिनल फ़ाइल को ओवरराइट करती है और कोई बैकअप नहीं रखा जाता। साथ चलने से पहले, Settings › General खोलें और Replace source ऑफ करें, या एक अलग आउटपुट फ़ोल्डर चुनें।
स्कैन पर OCR चलाएं
- PDF Tools › OCR खोलें (टूल पेज)।
- स्कैन की गई PDF ड्रॉप करें।
- इसे चलाएं। हर पेज 300 DPI पर रेंडर और पहचाना जाता है, इसलिए लंबी स्कैन में समय लगता है — प्रोग्रेस प्रति पेज होती है।
- अपने आउटपुट स्थान पर
<name>_ocr.txtखोजें। पेज--- Page Break ---लाइन से अलग होते हैं।
क्या मिलता है (और क्या नहीं)
- आउटपुट एक साधारण
.txtहै — शब्द और लाइन ब्रेक, कोई लेआउट नहीं, कोई फ़ॉन्ट नहीं। दो-कॉलम स्कैन सीधी पढ़ी जाती है। - पहचान सिर्फ़ अंग्रेज़ी है। दूसरी भाषाओं के पेज बिगड़े या खाली निकलते हैं।
- साफ़, सपाट स्कैन उचित कंट्रास्ट पर अच्छी पहचानी जाती हैं। हस्तलेखन, स्टाम्प, टेढ़ी तस्वीरें और धुंधला थर्मल-पेपर टेक्स्ट मैन्युअल सफ़ाई मांगेंगे।
- OCR searchable PDF नहीं बनाती — यह टेक्स्ट निकालती है। इसके बजाय Word में एडिटेबल पैराग्राफ चाहिए तो Scanned PDF to Word इस्तेमाल करें।
अगर टेक्स्ट दूसरे फ़ॉर्मैट में चाहिए
- Scanned PDF to Word वही OCR चलाता है लेकिन साधारण पैराग्राफ की
.docxलिखता है — देखें PDF to Word। - PDF Tools › Extract Text डिजिटल PDF की एम्बेडेड टेक्स्ट लेयर कॉपी करता है — तुरंत, लेकिन स्कैन पर कुछ नहीं मिलता क्योंकि स्कैन में टेक्स्ट लेयर नहीं होती।
संबंधित पेज
- PDF to Word: विज़ुअल बनाम टेक्स्ट मोड
- PDF को प्रोटेक्ट और रिडैक्ट करें — अगर Detect PII स्कैन की गई फ़ाइल रिपोर्ट करे तो पहले OCR करें
- लोकल OCR और प्राइवेसी
- फ़ाइलें कभी अपलोड क्यों नहीं होतीं
- PDF कंप्रेस करें
इस्तेमाल किए टूल