PDF を Word に変換
PDF からテキストを抽出し、編集可能な Word 文書にオンラインで変換。
⚠️ Limitations
- Scanned PDFs (image-only) cannot be converted — text extraction only
- Complex layouts, tables, and images are not preserved
- Best results with text-heavy documents
ファイルをドロップまたはクリックしてアップロード
Max 100 MB
PDF から Word への変換は、固定レイアウトの PDF を再び編集可能な .docx に戻す作業です。「この文書を編集したいのに PDF しか手元にない」という定番の状況——契約書の更新、履歴書の修正、コンテンツを新しい文書へ流用——で使われます。 この変換は本質的に不完全です。PDF はピクセル精度の座標でテキストを保持しているので、段落の流れや意味構造を復元するには推論が必要です。単純な文書(一段組の記事、飾り気のないレポート)はきれいに変換されますが、複雑なもの(多段組、浮動テキストボックス、大きな表)は、あとで Word 内での手直しがほぼ必要です。 すべてブラウザ内で動きます。ツールは pdfjs-dist で PDF からテキストと構造の手がかりを取り出し、`docx` ライブラリで Microsoft 互換の .docx ファイルを組み立てます。アップロードもクラウドサービスもありません。
最終確認: 2026年7月
この機能について
PDF は「閲覧」のために設計されており、「編集」のために作られてはいません。文字は固定のページ座標に置かれ、「これは見出し」「これは段落」といった意味的マークアップは付いていません。Word への変換はこの過程を逆にたどることです:文字を単語にまとめ、Y 座標に基づいて単語を行に、行間隔のパターンに基づいて行を段落に組み立てます。フォントサイズや太字などは PDF の文字メタデータから推測し、見出しレベルを当てはめます。表がいちばん厄介です。PDF は表を座標上の文字として描くだけで、行列構造を明示していないことがあり、検出はヒューリスティックに頼るため、複雑なレイアウトでは失敗しがちです。
使い方
- 1変換する PDF を選びます。テキストベースの PDF(Word・LibreOffice・その他のワープロで作成されたもの)がもっともよく変換できます。スキャン PDF は先に OCR が必要です——OCR ツールでテキストレイヤーを追加してから変換してください。
- 2テキスト抽出の完了を待ちます。ツールは各ページを解析し、文字を座標と共に取り出し、段落へまとめます。1ページあたり1〜5秒かかります。
- 3処理をクリックします。ツールは段落、基本的な書式(太字、斜体、下線)、検出された見出しを保持した .docx を組み立てます。元の PDF に埋め込まれた画像は、複雑度に応じて保持される場合とされない場合があります。
- 4.docx をダウンロードし、Word か LibreOffice で開いてください。ある程度の手直しは覚悟してください——改行の調整、表の再フォーマット、複雑なレイアウトでは画像の再挿入が必要になることもあります。
使い方のコツ
- ツールは段落テキストの保存には強いですが、精密なレイアウトはしばしば失われます。ひと目で PDF と同じ見た目になるとは思わないでください。
- スキャン PDF ではまず OCR ツールでテキストレイヤーを追加してください。OCR がないと抽出できるテキストがなく、空の文書ができあがります。
- 特殊なエンコーディングの PDF から抽出したテキストには文字化けが混じることがあります。フル変換にかける前に「テキスト抽出」ツールでテキストがきれいに取り出せるか確認してください。
- 多段組の PDF(学術論文など)は、各段を上から下へたどるのではなく、段をまたいで読む順序で抽出されることがよくあります。Word での並べ替えが必要になる場合があります。
- 表は整列した文字位置に基づくヒューリスティックで検出されます。セル結合や入れ子構造を持つ複雑な表はたいてい失敗するので、Word で手動で作り直してください。
よくある用途
- PDF で送られてきた履歴書を採用担当が転送前に応募者の連絡先だけ編集する。
- 学生が講義 PDF を Word に変換し、個人メモを書き足せるノート形式に整える。
- 翻訳者がスキャンした技術文書のテキストを Word に取り出して翻訳し、その結果を整形する。
- コンサルタントが古い提案 PDF(元の Word が行方不明)を編集して、新しいクライアント向けに日付と数字を更新する。
- ライターが公開済みの記事 PDF を Word の下書きに戻し、より長い作品へ編集・拡張する。
- 研究者が学術 PDF からテキストを抽出し、打ち直さずに原稿へ引用を含める。
技術メモ
- ツールは pdfjs-dist で位置データ付きのテキスト抽出を行い、`docx` npm ライブラリで .docx を組み立てます。
- 段落の復元は垂直座標のクラスタリングを使います。近接する行は同じ段落、大きな空きがあれば段落の区切りになります。
- 書式(太字、斜体)は PDF の文字レベルのフォントメタデータから推測されます。検出した属性は Word の実行書式に転写されます。
- PDF に埋め込まれた画像は、可能な限り本文行内の画像として抽出・再挿入されます。複雑な位置指定(テキストの回り込み)は失われます。
- テキスト抽出速度はページの複雑度に依存します。一段組の記事は毎秒 5〜10 ページ、複雑なレイアウト(多段組、大きな表)は毎秒 1〜3 ページです。
- 出力は .docx で、Word 2007 以降、LibreOffice Writer、Google Docs で開けます。
プライバシーを前提に設計
このツールはブラウザ内で動作します。利用中にファイルが当社サーバーへアップロードされることはありません。
制限事項
- スキャン PDF(画像のみでテキストレイヤーなし)は空の .docx を生成します。先に OCR でテキストレイヤーを追加してください。
- 多段組レイアウトはテキストが正しくない順序で抽出されがちです。通常、Word での並べ替えが必要になります。
- 複雑な表(結合セル、入れ子の表、行またぎ)はきれいに変換できることが少なく、手動で作り直してください。
- テキストボックス、浮動シェイプ、ヘッダーやフッターは正確に保持されないか、予想外の位置に落ちることがあります。
- PDF で使われているカスタムフォントが読者側のシステムにないと、Word の既定フォントに置き換えられます。
- パスワード保護された PDF は処理できません。先に「保護」ツールでパスワードを外してください。
よくある質問
変換後の Word が PDF と違って見えるのはなぜですか?
PDF から Word への変換は、固定されたピクセル位置から段落構造を復元する必要があります。テキストと基本的な書式はしっかり残りますが、正確なレイアウト——段の位置、表の罫線、浮動要素——は Word 側で手直しが必要なことが多いです。
スキャンした PDF を変換できますか?
先に OCR を実行した場合のみ可能です。スキャン PDF に含まれるのは文字の画像であって文字コードそのものではありません。OCR ツールでテキストレイヤーを追加してから変換してください。OCR なしでは抽出するテキストがなく、出力される .docx は空になります。
出力に表は保持されますか?
セル境界がはっきりしたシンプルな表はそれなりに変換できます。セル結合、入れ子の表、こだわった書式を含む複雑な表はたいてい失敗し、無書式の段落テキストにフォールバックします。手動で作り直してください。
PDF の画像は保持されますか?
可能な範囲で保持されます。テキストと同じ行に置かれたシンプルな配置の画像は抽出されて再挿入されます。複雑なテキスト回り込みや重ね合わせの画像は、.docx 内で想定外の位置に置かれるか、まったく省かれることもあります。
出力を開ける Word のバージョンは?
.docx は Word 2007 以降、LibreOffice Writer、Google Docs、Apple Pages(読み取りモード)およびその他の DOCX 互換エディタで開けます。標準的な Office Open XML です。
パスワード保護された PDF を変換できますか?
いいえ。パスワード保護された PDF は復号するまで解析できません。先に「保護」ツールでパスワードを外してください。
一部の PDF の変換が遅く感じるのはなぜですか?
多段組レイアウト、大きな表、多くの埋め込み画像を含む複雑な PDF は時間がかかります。抽出速度は、単純な文書で毎秒 5〜10 ページ、複雑な文書で毎秒 1〜3 ページです。
変換品質に満足できないときの代替は?
高忠実度の変換なら、Adobe Acrobat Pro の「Word へエクスポート」機能や Google Docs の PDF インポートの方が、どのブラウザベースのツールよりもレイアウトを保持できます。本ツールは「アップロードなしで素早く」に最適化されており、テキスト中心のコンテンツでレイアウト精度を犠牲にするトレードオフです。
PDF はサーバーに送られますか?
いいえ。変換は pdfjs-dist と docx ライブラリを使ってブラウザ内で行われます。ファイルは端末を離れません。タブを閉じれば作業データはすべて破棄されます。