OCR งานสแกนเป็นข้อความ (ภาษาอังกฤษ)
สกัดข้อความจาก PDF งานสแกนด้วย OCR ออฟไลน์บนเครื่องของคุณ รองรับเฉพาะภาษาอังกฤษ ผลลัพธ์เป็นไฟล์ .txt ธรรมดา — นี่คือสิ่งที่จะได้แน่ ๆ
เครื่องมือ OCR ใน 1FileTool เปลี่ยน PDF งานสแกนเป็นไฟล์ข้อความธรรมดาบน Mac ของคุณ — ไม่อัปโหลด ไม่ใช้บริการ OCR บนคลาวด์ รู้จักข้อความภาษาอังกฤษเท่านั้นและเขียนไฟล์ .txt ไม่ใช่ PDF ที่ค้นหาได้
ปกป้องไฟล์ต้นฉบับของคุณก่อน
Replace source เปิดอยู่ตามค่าเริ่มต้น: ไฟล์ผลลัพธ์จะเขียนทับไฟล์ต้นฉบับและไม่มีการสำรองไว้ ก่อนทำตาม ให้เปิด Settings › General แล้วปิด Replace source หรือเลือกโฟลเดอร์ผลลัพธ์อื่น
รัน OCR บนงานสแกน
- เปิด PDF Tools › OCR (หน้าเครื่องมือ)
- วาง PDF งานสแกน
- รันเลย แต่ละหน้าถูกเรนเดอร์ที่ 300 DPI แล้วจดจำ งานสแกนยาวจึงใช้เวลา — ความคืบหน้าเป็นรายหน้า
- หา
<name>_ocr.txtในตำแหน่งผลลัพธ์ของคุณ หน้าถูกคั่นด้วยบรรทัด--- Page Break ---
สิ่งที่ได้ (และไม่ได้)
- ผลลัพธ์เป็น
.txtธรรมดา — คำและตัวขึ้นบรรทัด ไม่มีเลย์เอาต์ ไม่มีฟอนต์ งานสแกนสองคอลัมน์จะถูกอ่านไหลผ่านกัน - การจดจำเป็นภาษาอังกฤษเท่านั้น หน้าที่เป็นภาษาอื่นออกมาเพี้ยนหรือว่างเปล่า
- งานสแกนเรียบสะอาดที่คอนทราสต์พอเหมาะจดจำได้ดี ลายมือ ตราประทับ รูปที่เอียง และตัวหนังสือจาง ๆ บนกระดาษความร้อนต้องแก้ไขด้วยมือ
- OCR ไม่ได้สร้าง PDF ที่ค้นหาได้ — มันสกัดข้อความ ถ้าต้องการย่อหน้าที่แก้ไขได้ใน Word ใช้ Scanned PDF to Word
ถ้าต้องการข้อความในฟอร์แมตอื่น
- Scanned PDF to Word รัน OCR เดียวกันแต่เขียน
.docxของย่อหน้าธรรมดา — ดู PDF เป็น Word - PDF Tools › Extract Text คัดลอกเลเยอร์ข้อความที่ฝังของ PDF ดิจิทัล — ทันที แต่หาอะไรไม่เจอบนงานสแกนเพราะงานสแกนไม่มีเลเยอร์ข้อความ
ที่เกี่ยวข้อง
- PDF เป็น Word: โหมดภาพเทียบโหมดข้อความ
- ป้องกันและปิดข้อมูล PDF — OCR ก่อนถ้า Detect PII รายงานว่าเป็นไฟล์สแกน
- OCR ในเครื่องและความเป็นส่วนตัว
- ทำไมไฟล์ไม่ถูกอัปโหลด
- บีบอัด PDF
เครื่องมือที่ใช้