PDF to Word: visuaalinen vs tekstitila, skannatut PDF:t
Muunna PDF .docx:ksi offline — visuaalinen tila säilyttää asettelun, tekstitila antaa muokattavat kappaleet, ja Scanned PDF to Word hoitaa skannaukset.
1FileTool muuntaa PDF:n Wordiksi offline Macillasi — tiedostoa ei koskaan ladata, ja tulos laskeutuu nimellä <name>_converted.docx. Kolme työkalua kattaa työn, ja valinta riippuu siitä, välittäätkö asettelusta vai muokattavasta tekstistä.
Suojaa alkuperäisesi ensin
Replace source on oletuksena PÄÄLLÄ: tuloste ylikirjoittaa alkuperäisen tiedoston eikä varmuuskopiota säilytetä. Ennen kuin seuraat mukana, avaa Settings › General ja käännä Replace source pois, tai valitse erillinen tulostekansio.
Kolme työkalua
- PDF Tools › PDF to Word — visuaalinen tila. Jokainen sivu upotetaan .docx:ään koko sivun kuvana, joten Word-tiedosto näyttää täsmälleen PDF:ltä. Paras, kun asettelu on se tärkeä asia. (PDF to Word)
- PDF Tools › Scanned PDF to Word — ajaa OCR:n jokaiselle sivulle ja kirjoittaa pelkät kappaleet. Paras, kun PDF on skannaus ja tarvitset muokattavaa tekstiä. (Scanned PDF to Word)
- PDF Tools › Batch PDF to Word — visuaalinen tila koko pudotettuun kansioon. (Batch PDF to Word)
Mitä kukin tila tuottaa
Visuaalinen tila — PDF to Wordin ja Batch PDF to Wordin oletus — renderöi jokaisen PDF-sivun ja sijoittaa sen dokumenttiin kuvana. Fontit, taulukot, kuvat ja sarakeasettelu säilyvät pikseli pikseliltä. Kompromissi: sisällä oleva teksti on osa kuvaa, joten sitä ei voi muokata Wordissa.
Tekstitila — mitä Scanned PDF to Word käyttää — poimii todellisen tekstin ja kirjoittaa sen tavallisina kappaleina. Tulos on täysin muokattava, mutta monimutkaiset asettelut romahtavat yksinkertaiseksi kappalevirraksi: monisarakeinen skannaus muuttuu yhdeksi tekstipatsaaksi.
Skannatun PDF:n muuntaminen
Skannaus on sivun valokuva — tekstikerrosta ei ole kopioitavaksi. Scanned PDF to Word ajaa englanninkielisen OCR:n jokaiselle sivulle ja kirjoittaa tunnistetut sanat kappaleina:
- Pudota skannattu PDF Scanned PDF to Word -työkaluun.
- Aja se. OCR vie selvästi enemmän aikaa kuin tavallinen muunto — sivu pitää renderöidä ja tunnistaa.
- Avaa
<name>_converted.docxja oikolue se. OCR puhtaalla skannauksella on lähellä; käsiala, leimat ja haalea teksti vaativat korjauksia.
Jos tarvitset vain sanat — et Word-tiedostoa — OCR kirjoittaa pelkän .txt-tiedoston sen sijaan.
Jos ajo palaa tyhjänä
PDF ilman tekstikerrosta ja tunnistettavaa kuvasisältöä voi epäonnistua virheellä, joka kehottaa kokeilemaan Scanned PDF to Wordiä. Aja tiedosto uudelleen tuolla työkalulla — se OCRaa sen sijaan että poimisi.
Aiheeseen liittyvät
Käytetyt työkalut