このツールとは?
このツールはPDFの各ページのテキスト内容を読み取り、Excelブック内で行と列として再構成します(1ページにつき1シート)。垂直方向の位置に基づいてテキストを行にまとめ、単語間に広い水平方向の間隔がある箇所でその行をセルに分割します。これは単なる空白ではなく「ここから新しい列」であることを示す妥当な目安として機能します。
この推測方式は、請求書、価格表、エクスポートされたレポートなど、シンプルで均等な間隔の表やリストを持つPDFに対してよく機能します。結合セル、セル内の複数行のテキスト、列間の間隔が不明瞭な表など、複雑なレイアウトを確実に再構成することはできません。そうした場合は、ダウンロード後に結果を手動で調整する必要があります。
なぜこれを使うのか?
- PDFの表やリストを、手入力し直すことなく編集・並べ替え可能なExcelファイルに変換できます。
- 登録不要、透かしなし、完全無料です。
- ローカル処理でプライバシーも安心——PDFがサーバーにアップロードされることはありません。
- PDFの1ページにつき1シートなので、複数ページの文書でも整理された状態を保てます。
使い方
- ボックスをクリックするか、PDFファイルをドラッグ&ドロップしてください。
- ツールがテキストを抽出し、行と列に整列させるのを待ちます。
- .xlsxファイルをダウンロードし、Excel、Googleスプレッドシート、または任意の表計算アプリで開きます。
- 列の分割結果を確認してください——複雑な表では、一部のセルを手動で調整する必要がある場合があります。
例
入力
invoice.pdf — 明細表を含む1ページの請求書出力
invoice.xlsx — 請求書の各明細行が1行として並び、品目・数量・価格の列を持つシート変換精度は元のPDFのレイアウトに大きく左右されます。列間の間隔が明確なシンプルな表はきれいに変換されますが、密集した表や間隔が不規則な表は手動での整理が必要になる場合があります。
よくある質問
一部の列が結合されたり、誤って分割されたりするのはなぜですか?
このツールはPDF内部のテキストレイヤーにおける単語間の水平方向の間隔から列の境界を推測しています。PDFの元の表構造にはアクセスできません(そもそも大半のPDFはそうした構造を保持していません)。列同士が近接していたり、表が特殊な間隔を使用していたりすると、推測が誤る場合があります。結果を確認し、必要に応じて手動で調整してください。
スキャンしたPDFにも対応していますか?
いいえ。このツールはPDFに埋め込まれたテキストレイヤーを読み取ります。スキャンされた文書は単なる画像であり、抽出可能なテキストを持ちません。先にPDF OCRツールでテキストレイヤーを追加してから、この変換ツールをご利用ください。
私のPDFはサーバーにアップロードされますか?
いいえ。テキストの抽出とExcelファイルの生成は、いずれもJavaScriptを使ってブラウザ内でローカルに行われます。ファイルがお使いの端末から出ることはありません。
元の表のセル書式、色、結合セルは保持されますか?
いいえ。出力結果はグリッド状に配置された単なるテキストです。元のPDFのフォント、色、罫線、結合セルは引き継がれません。