स्कैन का OCR टेक्स्ट में (अंग्रेज़ी)

ऑफ़लाइन OCR से स्कैन की गई PDF से टेक्स्ट निकालें। सिर्फ़ अंग्रेज़ी पहचान, आउटपुट एक साधारण .txt फ़ाइल है — यहां बिल्कुल वही है जो मिलेगा।

1FileTool का OCR टूल स्कैन की गई PDF को आपके Mac पर साधारण टेक्स्ट फ़ाइल में बदल देता है — कोई अपलोड नहीं, कोई क्लाउड OCR सेवा नहीं। यह सिर्फ़ अंग्रेज़ी टेक्स्ट पहचानता है और .txt फ़ाइल लिखता है, searchable PDF नहीं।

पहले अपनी ओरिजिनल फ़ाइलें सुरक्षित करें

Replace source डिफ़ॉल्ट ऑन है: आउटपुट ओरिजिनल फ़ाइल को ओवरराइट करती है और कोई बैकअप नहीं रखा जाता। साथ चलने से पहले, Settings › General खोलें और Replace source ऑफ करें, या एक अलग आउटपुट फ़ोल्डर चुनें।

स्कैन पर OCR चलाएं

  1. PDF Tools › OCR खोलें (टूल पेज)।
  2. स्कैन की गई PDF ड्रॉप करें।
  3. इसे चलाएं। हर पेज 300 DPI पर रेंडर और पहचाना जाता है, इसलिए लंबी स्कैन में समय लगता है — प्रोग्रेस प्रति पेज होती है।
  4. अपने आउटपुट स्थान पर <name>_ocr.txt खोजें। पेज --- Page Break --- लाइन से अलग होते हैं।

क्या मिलता है (और क्या नहीं)

  • आउटपुट एक साधारण .txt है — शब्द और लाइन ब्रेक, कोई लेआउट नहीं, कोई फ़ॉन्ट नहीं। दो-कॉलम स्कैन सीधी पढ़ी जाती है।
  • पहचान सिर्फ़ अंग्रेज़ी है। दूसरी भाषाओं के पेज बिगड़े या खाली निकलते हैं।
  • साफ़, सपाट स्कैन उचित कंट्रास्ट पर अच्छी पहचानी जाती हैं। हस्तलेखन, स्टाम्प, टेढ़ी तस्वीरें और धुंधला थर्मल-पेपर टेक्स्ट मैन्युअल सफ़ाई मांगेंगे।
  • OCR searchable PDF नहीं बनाती — यह टेक्स्ट निकालती है। इसके बजाय Word में एडिटेबल पैराग्राफ चाहिए तो Scanned PDF to Word इस्तेमाल करें।

अगर टेक्स्ट दूसरे फ़ॉर्मैट में चाहिए

  • Scanned PDF to Word वही OCR चलाता है लेकिन साधारण पैराग्राफ की .docx लिखता है — देखें PDF to Word।
  • PDF Tools › Extract Text डिजिटल PDF की एम्बेडेड टेक्स्ट लेयर कॉपी करता है — तुरंत, लेकिन स्कैन पर कुछ नहीं मिलता क्योंकि स्कैन में टेक्स्ट लेयर नहीं होती।

संबंधित पेज

इस्तेमाल किए टूल

Keep the next file job off the internet.

Every tool is in the free download. Upgrade once, when the daily limit starts getting in your way.

PrivateOfflinePay once

No account, no credit card. Pro includes a 7-day money-back guarantee.