PDFから表を抽出
スキャンしたPDFでも、PDFから表を抽出するにはどうすればよいですか?
LinnkのPDFから表を抽出するツールにファイルをアップロードすると、見つかったすべての表がExcelブックに書き出されます。ソフトウェアから書き出したPDFでも、コピー機でスキャンしたPDFでも同じです。難しいのは後者です。多くのPDF表抽出ツールはファイル内の隠れたテキストレイヤーを読み取りますが、スキャンしたページにはそれがなく、中身は画像だけです。Linnkはページ画像そのものを読み取ります。AIモデル(LinnkはChatGPT、Claude、Geminiのモデルを使用)が各ページを構造化されたテキストとして組み立て直し、表を見つけ出して、表ごとに1シート、ページにちなんだシート名、結合された見出しセルは本物の結合セルのままでブックに書き出します。同じ処理で、表ごとのCSV、ページの見た目に近いレイアウト版スプレッドシート、検索可能なPDFも手に入ります。金額、日付、口座番号は1桁ずつそのまま写し取られ、モデルが読み取れない数字は推測せずに「?」で示されます。知っておきたい制限が2つあります。複数ページにまたがる表は1つにつながらず、ページごとに1シートになります。また、表のないPDFには行を作り出さず、表がない旨の注記が付きます。まっすぐで明るいスキャンほど読み取りやすく、薄いページや傾いたページは念のため確認が必要な場合があります。
Last updated: 2026年10月
PDFから表を抽出してExcelにする方法
インストール不要、3ステップで完了するオンラインのPDF表抽出。
PDFをアップロード
スキャンしたPDFまたはデジタルPDFを追加します。出力形式はあらかじめExcelが選ばれ、出力言語は「元の言語のまま」に設定されています。すべてのページを画像として読み取るため、コピー機のスキャンもソフトから書き出したレポートも同じ手順で処理されます。
最初の表を確認
通常は1ページあたり1分以内に、プレビューで最初の表がグリッド表示されます(表示される行数には上限があります)。認識したテキストのコピーは無料です。ほかの表はダウンロードに含まれます。まず「?」の付いたセルを確認してください。スキャン上ではっきり見えなかった数字です。
Excelブックをダウンロード
ダウンロードには無料アカウントでのログインが必要です。CSVファイル(表ごとに1つ、複数ある場合はZIPにまとめます)、レイアウト版スプレッドシート、検索可能なPDFは同じ変換から作成され、Markdownとプレーンテキストも同様です。Wordファイルが必要な場合は、ご依頼に応じて数分ほど追加で作成します。
きれいなデジタルPDFだけでなく、スキャンPDFから表を抽出するために設計
銀行の取引明細、請求書、決算資料、検査報告書、紙から電子化した保管資料に。
表ごとに1シート、シート名はページ別
12ページに貸借対照表、14ページにキャッシュフロー計算書がある決算資料なら、それぞれのページ名が付いた2つのシートになります。数字に違和感があれば、すぐに元のページに戻って確認できます。結合された見出しセルは本物の結合セルのまま残るので、2段の見出しもPDFと同じ見た目になります。
デジタルPDFだけでなく、スキャンPDFもエクセルに変換
多くの表抽出ツールは、スキャンにはないテキストレイヤーを頼りにしています。Linnkはページ画像を読み取るため、FAXで届いた明細書、コピー機のスキャン、古い保管資料のページも、書き出したレポートと同じようにExcelに変換できます。まっすぐできれいなスキャンほど読み取りやすくなります。
数字は推測せず、そのまま写す
金額、口座番号、日付、数量は1桁ずつそのまま写し取ります。薄くて読めない数字は「?」、判読できない箇所は[illegible]で示されるので、列を合計する前にどのセルを確認すべきかがわかります。
存在しない表は作らない
PDFに表がない場合、ExcelブックとCSVには行を作り出さず、その旨が表示されます。同じアップロードから、レイアウト版スプレッドシート、検索可能なPDF、Markdown、プレーンテキストは引き続き受け取れます。
言語はそのまま、または翻訳も
元の言語のまま出力することも、同じ処理で翻訳することもできます。初期設定では、中国の仕入先から届いた明細書は中国語のまま出力され、日本語、韓国語、アラビア語、ヘブライ語の表もそれぞれの文字で読み取られます。
同じアップロードからCSVとレイアウト版も
Excelファイルに加えて、表ごとのCSV(UTF-8なので、アクセント付き文字や日本語などの非ラテン文字も正しく開けます)、元のページに近い見た目で1ページ1シートのレイアウト版スプレッドシート、実際のテキストとして組み直した検索可能なPDFも手に入ります。
PDF表抽出の基本情報
PDFをアップロードする前に知っておきたいこと。
入力
- スキャン・デジタル両対応
- 画像
- JPG, PNG, WEBP, HEIC, HEIF
- 非対応
- Word, PowerPoint, Excel
- 言語
- 初期設定では元のまま
出力
- Excel(表)
- 表ごとに1シート、シート名はページ別
- CSV
- 表ごとに1ファイル、UTF-8
- スプレッドシート(レイアウト)
- 1ページ1シート、ページに近い配置
- 複数ページにまたがる表
- ページごとに1シート、結合しない
精度
- 数字と日付
- 1桁ずつそのまま転記
- 読めない数字
- 「?」で表示、推測しない
- 結合セル
- 本物の結合セルのまま
- 表のないPDF
- その旨を表示、作り出さない
速度と利用条件
- 速度
- 通常1ページあたり1分以内
- プレビュー
- 無料・登録不要
- ダウンロード
- 無料アカウント
- 長い文書
- 有料プラン、linnk.ai/pricing を参照
PDFから表を抽出する方法の比較
PDFの表をExcelに移す一般的な方法とLinnkを比べました。
| Feature | Linnk PDFから表を抽出 | コピー&ペースト | テキストレイヤー型の表抽出ツール | 表計算ソフトのPDF取り込み |
|---|---|---|---|---|
| スキャンPDF | ページ画像から読み取り | 通常は選択できる文字がない | 通常は先にOCRが必要 | 通常はテキストを含むPDFが必要 |
| 1つのPDFに複数の表 | 表ごとに1シート、シート名はページ別 | 1つずつ手作業 | 通常は1つずつ選択 | 検出された表の一覧から選択 |
| 結合された見出しセル | 本物の結合セルのまま | 通常は失われる | ツールによる | ツールによる |
| 不鮮明・判読できない数字 | 「?」で表示 | ご自身の判断 | デジタルPDFではテキストレイヤーから転記 | デジタルPDFではテキストレイヤーから転記 |
| 複数ページにまたがる表 | ページごとに1シート、結合しない | 手作業でつなぐ | ツールによる | ツールによる |
| 表の言語 | そのまま、または同じ処理で翻訳 | そのまま | そのまま | そのまま |
| 同じファイルからのほかの出力 | CSV、レイアウト版スプレッドシート、検索可能なPDF、Markdown、テキスト | なし | ツールによる(CSVが多い) | ブックのみ |
2026年9月時点の比較です。他のツールはバージョンや設定によって異なるため、最新の機能は各ツールでご確認ください。
Linnkで表データを取り出している方々
PDFに閉じ込められた数字を、スプレッドシートに移したい方へ。
経理・会計担当者
スキャンした銀行明細やカード利用明細から取引の表を取り出し、照合作業に使います。明細の各ページがそれぞれのシートに入るので、1つの元帳にまとめて貼り付けられます。
財務アナリスト
決算資料のPDFから貸借対照表や損益計算書を分析モデルに移し、数字を打ち直す手間を省きます。そのうえで印の付いたセルを確認します。
買掛金・購買担当者
スキャンPDFで届く仕入先の請求書や価格表を、発注書と突き合わせられる行データに変えます。
研究者・学生
スキャンでしか残っていない古い論文や学位論文からデータ表を取り出し、スプレッドシートや統計ソフトに取り込みます。
監査・コンプライアンス部門
スキャンした届出書類、許認可書類、検査台帳の表をサンプリング用のブックに写します。各シート名で元のページがわかります。
輸入・物流チーム
PDFで送られてくるパッキングリスト、運賃表、通関書類を元の言語のままExcelに変換するので、品名が仕入先の表記と一致します。