このツールとは?
このツールはPDFのテキストレイヤー(画像ではなく、ファイルに埋め込まれた実際に選択・コピー可能なテキスト)を読み取り、新しいWord文書として再構築します。検出された各行が段落となり、元のPDFの各ページの間に改ページが挿入されます。レポートや記事、書き出された文書などテキストベースのPDFがあり、全部打ち直すことなく文章をコピー・編集・再利用したい場合に便利です。
正直に言うと、これはレイアウトを保持する変換ツールではなく、テキスト抽出ツールです。複数段組みのレイアウト、表、ヘッダー/フッター、特定のフォント、埋め込み画像をPDFに表示されていた通りに再現することはありません。もしPDFがスキャンされた画像(テキストレイヤーのない写真やスキャン)である場合、このツールは抽出できるテキストを見つけられません。その場合は先にOCRツールで画像からテキストを認識する必要があります。
なぜこれを使うのか?
- 静的なPDFのテキストを、打ち直すことなく数秒で編集可能なWord文書に変換します。
- ブラウザ内で完全にオフライン動作 — PDFファイルはサーバーにアップロードされません。
- 無料・登録不要、ページ数の制限はお使いのブラウザの処理能力次第です。
- 限界について正直です。元のレイアウトを完璧に再現するふりをせず、テキストを抽出するツールとして提供しています。
使い方
- ボックスをクリックするか、PDFファイルをドラッグ&ドロップします。
- テキストが抽出され、Word文書が生成されるまで待ちます。
- ダウンロードボタンをクリックして.docxファイルを保存します。
例
入力
report.pdf — 3ページのテキスト文書出力
report.docx — 抽出されたテキストを含む編集可能なWordファイル。元の3ページ間の改ページが保持されます各行のテキストはWord文書内の段落になります。元の視覚レイアウト、フォント、埋め込み画像は再現されません。
よくある質問
PDFの正確な書式は保持されますか?
いいえ、正確には保持されません。このツールはテキスト内容を抽出し、新しいWord文書内でシンプルな段落として再構築し、元のページ間に改ページを挿入します。複数段組みのレイアウト、表、特定のフォント、ヘッダー/フッター、埋め込み画像は再現しません。ピクセル単位でのレイアウト保持が必要な場合、このツールは適していません。テキスト内容の抽出・編集用に作られています。
なぜ「テキストが見つかりません」と表示されるのですか?
これはPDFがスキャンされた画像である場合に起こります。つまり、選択可能なテキストレイヤーがなく、単なるピクセルの集まり(ページの写真)だからです。このツールはPDFに埋め込まれた既存のテキストデータを読み取るものであり、画像からテキストを読み取るOCR(光学文字認識)は行いません。まずOCRツールでスキャン画像をテキストに変換する必要があります。
私のPDFはサーバーにアップロードされますか?
いいえ。変換処理(PDFの読み取りとWordファイルの生成)はすべてJavaScriptを使ってブラウザ内でローカルに行われます。ファイルがお使いの端末から出ることはないため、プライベートまたは機密性の高い文書にも安心してご利用いただけます。
ダウンロードされるファイル形式は何ですか?
標準的な.docxファイルで、Microsoft Word、Google Docs、LibreOffice Writer、その他Office Open XML形式に対応するワープロソフトと互換性があります。
パスワード保護されたPDFを変換できますか?
いいえ、現在は対応していません。このツールは暗号化やパスワード保護されたPDFを扱えません。変換前にPDF編集ツールでパスワード保護を解除する必要があります。