オフラインで PDF から Word:適切なツールの選び方
PDF をどこにもアップロードせずに DOCX に変換します。PDF to Word が実際に何を生成するか(レイアウト維持だが編集不可のページ画像)と、OCR を使う Scanned PDF to Word がその名にふさわしい場面を学びます。
進捗
PDF をどこにもアップロードせずに DOCX に変換します。1FileTool には3つの独立した Word ツールがあり、それぞれ本当に違うことをします——このチュートリアルでは同じファイルを各ジョブに合ったツールに通して、違いがもはや驚きでなくなるようにします。
必要なもの
- 1FileTool のインストール
- 2つのサンプル PDF:普通のテキスト契約書と、スキャンしたレシート(PDF に包まれた画像——中に本物のテキストはありません)
pdf-to-word-offline.zip
サンプルファイル · 29.5 KB
- agreement-text.pdf2.5 KB
- scan-receipt.pdf36.8 KB
まず元ファイルを守る
Replace source はデフォルトでオンです。出力が元ファイルを上書きし、バックアップは残りません。手順を始める前に Settings › General を開いて Replace source をオフにするか、別の出力フォルダを選んでください。
これらのツールでは、トグルは Put converted file at same location と表示されます:オンなら DOCX は元の PDF の隣に、オフなら出力フォルダに入ります。どちらも元のファイルには触れません。
手順
1. PDF to Word を開く
PDF Tools › PDF to Word(「Preserve PDF layout in DOCX」)を開き、agreement-text.pdf をゾーンにドロップします。
2. 実行して DOCX を開く
Run on 1 file を押します。agreement-text_converted.docx が PDF の隣(トグルがオフなら出力フォルダ)に書き込まれます。Word で開くと、各ページが全ページ画像として表示され、元とまったく同じ見た目です。
これが正直なトレードです:PDF to Word は各ページを画像として埋め込むことでレイアウトを維持します。 文書は同一に見えます——しかしテキストは編集できません。
3. 編集可能なテキストにはテキスト系ツールを実行
実際に編集できるテキストがほしい場合は、PDF Tools › Scanned PDF to Word を開いて agreement-text.pdf をもう一度ドロップします。こちらはページに OCR を実行し、プレーンで編集可能な段落を書き出します——レイアウトはクリーンなテキストの列に簡略化されます。
4. 実際のスキャン PDF を変換する
scan-receipt.pdf を Scanned PDF to Word にドロップします。これがこのツールが存在する理由の仕事です:PDF に抽出可能なテキストがなく、OCR がピクセルを読み、編集可能なテキストを返します。
5. フォルダ全体を一度に
まとまったファイルには、PDF Tools › Batch PDF to Word がビジュアル(ページ画像)モードで一括変換します——ソースごとに1つの *_converted.docx ができます。
結果
1つの PDF から、それぞれ存在理由の異なる2つの DOCX が生まれます:見た目は同一だが編集できないビジュアル版と、質素だが編集できる OCR 版。PDF にテキストレイヤーがまったくない場合、OCR が唯一の入り口です——スキャンしたレシートで実行すれば、機能することが証明できます。
うまくいかない場合
- 「No text could be extracted from this PDF. Try Scanned PDF to Word.」——ファイルはスキャンまたは画像のみです。ツールを切り替えてください。
- DOCX に編集可能なテキストではなく画像がある:それは PDF to Word が言うとおりの仕事——レイアウト維持——をした結果です。編集が必要なら Scanned PDF to Word を使ってください。
- OCR 出力に誤字がある:OCR エンジンは英語のみで、きれいなスキャンで最もよく機能します。手書きや非英語テキストはこのバージョンの対象外です。
- DOCX が見つからない:Put converted file at same location トグルを確認——オンは「PDF の隣」、オフは出力フォルダです。
次に試すこと
変換したファイルにオフラインで PDF を圧縮を試し、PDF がスキャナー由来なら OCR ドキュメント がテキストエンジンが読めるものと読めないものを解説しています。
関連ページ
ドキュメントを読む