PDFファイルをアップロード
テキスト選択できるPDFをドラッグするか、ファイル選択ボタンから読み込みます。スキャンPDFは事前にOCR処理すると安定します。
ドキュメントユーティリティ
PDF文書内の表データを読み取り、CSVまたはExcelファイルとして保存できます。テキストベースのPDF表をページごとに分析し、抽出結果をプレビューしてダウンロードできます。
PDFファイルをアップロードし、ページ範囲と表認識感度を設定してください。テキストベースのPDFで最も安定して動作します。
Drag & Drop または
PDFアップロード / ページ分析 / 表候補抽出 / CSV・XLSX保存
空欄の場合は全ページを分析します。
列が細かく分かれすぎる場合は「広く」を選択してください。
行が細かく分割される場合は「広く」を選択してください。
CSV・XLSXダウンロード時に使用するファイル名です。
セル間隔が一定のテキストPDFほど精度が高くなります。
複数の表が混在する場合はプレビュー確認後に保存してください。
PDFの表構造に応じて設定を素早く適用できます。
選択ページ、候補数、現在の状態を確認できます。
抽出結果を確認してからCSVまたはXLSXとして保存できます。
テキスト選択できるPDFをドラッグするか、ファイル選択ボタンから読み込みます。スキャンPDFは事前にOCR処理すると安定します。
全ページまたは1-3,5のような範囲を指定し、表の配置に合わせて行・列の感度を調整します。
ページ別の表候補、行数、列数を確認し、ヘッダーや空行・空列の整理が適切か確認します。
データ取り込みにはCSV、Excelでそのまま編集する場合はXLSXを選んでダウンロードします。
PDFレポート、明細書、見積書、統計表、精算表などの表データをExcelやGoogleスプレッドシートで再利用したいときに便利です。抽出データをCSVまたはXLSXで保存できます。
このツールはPDF内のテキストと位置情報を読み取り、表構造を推定します。文字を選択できるPDFに向いており、画像だけのスキャンPDFは先にOCRが必要な場合があります。
列が細かく分かれすぎる場合は広くを選びます。別々の列が結合される場合は狭くを選ぶと改善することがあります。
1行が複数行に分かれる場合は広くを選び、複数行が1行にまとまる場合は狭くを試してください。最適値はPDFの行間や文字配置で変わります。
CSVは多くのシステムで扱いやすい汎用形式です。XLSXはExcelで直接編集したい場合に便利です。用途に合わせて選択してください。
精度は低くなる可能性があります。このツールはOCRではなくPDF内部のテキスト情報を解析します。画像だけのPDFは先にOCR処理が必要です。
列間隔感度を広くに変更して再抽出してください。文字間隔が狭いPDFでは広めの設定が安定する場合があります。
行間隔感度を狭くに変更してみてください。行間が狭い表では標準設定だと区切りが弱くなることがあります。
抽出された最初の行を列名として扱う設定です。最初の行が見出しなら有効にし、実データなら無効にしてください。
このユーティリティはブラウザ内でPDFを解析できます。通常の利用では選択したPDFをサーバーに保存しない構成で動作します。