PDF Wordiksi offline: valitse oikea työkalu
Muunna PDF DOCX:ksi lataamatta sitä minnekään. Opi mitä PDF to Word oikeasti tuottaa, ja milloin Scanned PDF to Word ansaitsee nimensä.
Edistymisesi
Muunna PDF DOCX:ksi lataamatta sitä minnekään. 1FileToolissa on kolme erillistä Word-työkalua ja ne tekevät aidosti eri asioita — tämä opastus ajaa samat tiedostot oikean läpi jokaiseen työhön, jotta ero lakkasi olemasta yllätys.
Mitä tarvitset
- 1FileTool asennettuna
- Kaksi esimerkki-PDF:ää: tavallinen tekstisopimus ja skannattu kuitti (kuva PDF:n sisään käärittynä — ei todellista tekstiä sisällä)
pdf-to-word-offline.zip
Esimerkkitiedostot · 29.5 KB
- agreement-text.pdf2.5 KB
- scan-receipt.pdf36.8 KB
Suojaa alkuperäisesi ensin
Replace source on oletuksena PÄÄLLÄ: tuloste ylikirjoittaa alkuperäisen tiedoston eikä varmuuskopiota säilytetä. Ennen kuin seuraat mukana, avaa Settings › General ja käännä Replace source pois, tai valitse erillinen tulostekansio.
Näissä työkaluissa kytkin on nimeltään Put converted file at same location: päällä, DOCX laskeutuu alkuperäisen PDF:n viereen; pois, se menee tulostekansioosi. Kumpikaan ei koske alkuperäiseen.
Vaiheet
1. Avaa PDF to Word
Avaa PDF Tools › PDF to Word ("Preserve PDF layout in DOCX") ja pudota agreement-text.pdf alueelle.
2. Aja se ja avaa DOCX
Paina Run on 1 file. agreement-text_converted.docx kirjoitetaan PDF:n viereen (tai tulostekansioosi jos kytkin on pois). Avaa se Wordissa: jokainen sivu näkyy kokosivun kuvana, täsmälleen alkuperäisen kaltaisena.
Tämä on rehellinen diili: PDF to Word säilyttää ulkoasun upottamalla jokaisen sivun kuvana. Dokumentti näyttää identtiseltä — mutta teksti ei ole muokattavissa.
3. Aja tekstipohjainen työkalu muokattavalle tekstille
Tekstille, jota voit oikeasti muokata, avaa PDF Tools › Scanned PDF to Word ja pudota agreement-text.pdf uudelleen. Tämä ajaa OCR:n sivujen yli ja kirjoittaa tavallisia, muokattavia kappaleita — ulkoasu on yksinkertaistettu siistiksi tekstipatsaaksi.
4. Muunna oikea skannattu PDF
Pudota scan-receipt.pdf Scanned PDF to Word -työkaluun. Tämä on se työ, jota varten työkalu on olemassa: PDF:ssä ei ole purkukelpoista tekstiä, OCR lukee pikselit, ja saat muokattavaa tekstiä takaisin.
5. Tee koko kansio kerralla
Tiedostopinolle PDF Tools › Batch PDF to Word muuntaa ne yhdessä ajossa visuaalisella (sivukuva) tilalla — yksi *_converted.docx per lähde.
Tulos
Kaksi erilaista DOCX:ää yhdestä PDF:stä, kummallakin oma syynsä olla olemassa: visuaalinen, joka näyttää identtiseltä mutta ei ole muokattavissa, ja OCR-versio, joka on pelkkä mutta muokattavissa. Kun PDF:ssä ei ole tekstikerrosta ollenkaan, OCR on ainoa tie sisään — ja sen ajaminen skannatulla kuitilla todistaa sen toimivan.
Jos se ei toiminut
- "No text could be extracted from this PDF. Try Scanned PDF to Word." — tiedosto on skannattu tai vain kuva; vaihda työkalua.
- DOCX:ssä on kuvia muokattavan tekstin sijaan: se on PDF to Word tekemässä täsmälleen mitä se sanoo — ulkoasun säilyttämistä. Käytä Scanned PDF to Wordia kun tarvitset muokattavuutta.
- OCR-tulosteessa on kirjoitusvirheitä: OCR-moottori on vain englanninkielinen ja toimii parhaiten puhtailla skanneilla; käsinkirjoitus ja ei-englanninkielinen teksti ovat sen ulottumattomissa tässä versiossa.
- En löydä DOCX:ää: tarkista Put converted file at same location -kytkin — päällä tarkoittaa "PDF:n viereen", pois tarkoittaa tulostekansiotasi.
Kokeile seuraavaksi
Pakkaa PDF:iä offline tiedostoille, joita muunnat — ja jos PDF tuli skannerista, OCR-docs kattavat mitä tekstimoottori voi ja ei voi lukea.
Aiheeseen liittyvät
Käytetyt työkalut