PDF OCR|スキャンしたPDFを文字認識して、検索できるPDFに

スキャンしたPDFの文字を検索したり、選択してコピーしたりしたいとお考えですか。スキャンをアップロードすると、Linnk が各ページを読み取り、本物のテキストを持つ検索可能なPDFとして作り直します。写真、印影、署名は元の位置に戻します。古い契約書、FAXで届いた申込書、保管資料の報告書、スマートフォンで撮影したページにも使えます。同じ処理から Markdown、プレーンテキスト、レイアウトを再現したスプレッドシートも受け取れ、ご希望に応じて Word ファイルも作成します。
出力形式
あわせて受け取れるもの Word · Markdown · プレーンテキスト · スプレッドシート(レイアウト)
出力言語
暗号化・プライバシー保護 154の言語と方言 表は表のまま ファイルは72時間後に削除

スキャンしたPDFを検索可能にするには?

PDFのOCR化とは、各ページの画像にOCR(光学文字認識)をかけ、文字を検索・選択・コピーできるテキストに変えることです。スキャンしたPDFはページを写した画像にすぎないため、Ctrl+F で検索しても何も見つからず、1行もコピーできません。Linnk の PDF OCR ツールは、AIモデル(Linnk は ChatGPT、Claude、Gemini のモデルを使用しています)で全ページを読み取り、構造化されたテキストとしてページを組み直したうえで、テキストベースの新しいPDFを書き出します。写真、ロゴ、印影、署名はスキャンから切り出し、元の位置に配置し直します。あらかじめはっきりお伝えすると、これは元の画像の上に透明なテキスト層を重ねる方式ではありません。PDFを作り直すため、見た目は原本に近いものの、ピクセル単位で同一にはなりません。色あせたり、汚れたり、傾いたりしたスキャンでは、ぼやけをそのまま引き継がず、くっきりとまっすぐなテキストになるため、かえって良い結果になることが少なくありません。数字、日付、ID は1桁ずつそのまま写し取り、OCRで読めない箇所は推測せずに印を付けます。それでも、薄いページや紙が反ったページには、ざっと目を通していただくことをおすすめします。

本物のテキスト全ページから再構成
保持写真・印影・署名
原文のまま文書の言語
無料プレビュー・アカウント不要

Last updated: 2026年9月

スキャンしたPDFをOCR化して検索できるようにする方法

ページの画像から、本物のテキストを持つPDFまで3ステップです。

1

スキャンをアップロード

スキャンしたPDF、またはページを撮影した JPG、PNG、WEBP、HEIC、HEIF の写真をドロップします。写真は1ページ分のスキャンとして扱われます。出力形式にはあらかじめ「検索可能なPDF」が選ばれており、テキストは元の言語のまま残ります。

2

OCRが各ページを読み取ります

AIモデルが各ページの画像を読み取り、テキストとして組み直します。通常は1ページあたり1分未満です。処理中は所要時間の目安が分単位で表示され、最初のページはアカウントなしで無料プレビューできます。

3

検索可能なPDFをダウンロード

無料登録で検索可能なPDFをダウンロードできます。Markdown、プレーンテキスト、レイアウト再現のスプレッドシートも同じ変換から作られ、Word ファイルはご依頼に応じて、数分ほど追加で作成します。

このPDF OCRツールでできること

もともとテキストを持たないスキャン、FAX、スマートフォンの写真のために作られています。

文字の画像ではなく、本物のテキスト

新しいPDFの文字はすべて実際のテキストデータです。Ctrl+F で見つかり、段落を選択してコピーでき、文書管理システムの全文検索の対象にもなります。

写真・印影・署名は元の位置に

ページ上の画像はスキャンから切り出して元の位置に戻すため、署名済みの契約書なら署名が、証明書なら公印が、通常はそのまま残ります。

状態の悪いスキャンも読みやすいテキストに

ページをなぞるのではなく組み直すため、傾いたり、薄かったり、コーヒーの染みがあったりするスキャンも、たいていはまっすぐで読みやすいテキストになります。ひどくぼやけたページは、念のため確認をおすすめします。

数字は1桁ずつそのまま

金額、日付、ID、参照番号は1桁ずつ写し取ります。OCRで判別できない数字は「?」で、読めない箇所は [illegible] で示すため、黙って推測で埋められることはありません。

同じ処理からほかの形式も

1回の変換で、Markdown、プレーンテキスト、1ページ1シートのレイアウト再現スプレッドシートも手に入ります。Word が必要な場合はご依頼に応じて作成し、通常は数分で完了します。

言語はそのまま、翻訳も可能

出力は既定で文書の元の言語のままです。「元の言語のまま」を翻訳に切り替えて言語を選べば、同じ処理で別の言語の検索可能なPDFを受け取れます。

PDF OCRの概要

スキャンをアップロードする前に知っておきたいこと。

入力

スキャンしたPDF
1ページずつ読み取り
スマートフォンの写真
JPG, PNG, WEBP, HEIC, HEIF
デジタルPDF
こちらも対応
Word、PowerPoint、Excel
このツールでは非対応

出力

検索可能なPDF
本物のテキストとして再構成
写真・印影・署名
元の位置に配置
同じ処理から
Markdown、テキスト、レイアウト再現スプレッドシート
Word ファイル
ご依頼に応じて作成

精度

数字・日付
1桁ずつそのまま写し取り
判別しにくい数字
「?」で表示
読めない箇所
[illegible] で表示
薄いページ・反ったページ
軽い確認をおすすめ

速度と利用条件

処理速度の目安
通常1ページあたり1分未満
プレビュー
無料・アカウント不要
ダウンロード
無料アカウントで可能
長い文書
有料プラン

スキャンしたPDFをOCRする方法の比較

検索可能なPDFを作る一般的な方法と Linnk の違いを、ほかの方法のほうが優れている点も含めてまとめました。

FeatureLinnk PDF OCRデスクトップ版PDFソフト無料のオンラインOCRサイトスキャナーアプリのOCR
PDFにテキストを入れる方法ページを本物のテキストとして再構成通常はスキャン画像の下に透明テキスト層通常は透明テキスト層(サイトによる)テキスト層、または別途テキスト書き出し
変換後のページの見た目原本に近いが、ピクセル単位で同一ではない元のスキャン画像をそのまま保持元のスキャン画像をそのまま保持元の写真を保持(トリミングや台形補正されることが多い)
薄い・傾いたスキャンくっきりまっすぐなテキストになる見た目はスキャンのまま見た目はスキャンのまま写真の傾きを補正するアプリもある
読めない文字[illegible] や「?」で表示製品によるサイトによるアプリによる
その他の出力形式Word、Markdown、プレーンテキスト、レイアウト再現スプレッドシートWord などへの書き出しに対応していることが多いさまざま(Word やテキストが多い)通常はPDFまたはテキスト
利用環境ブラウザ(インストール不要)インストール型ソフト(通常は有料)ブラウザスマートフォンアプリ

2026年9月時点の比較です。機能は製品やプランによって異なります。各カテゴリの一般的な動作を記載しています。

スキャンしたPDFを検索可能にしている方々

入力ではなくスキャンで作られた文書の中から、何かを探し出す必要があるすべての方に。

弁護士・パラリーガル

スキャンした契約書、訴訟書類、証拠書類をOCR化すれば、条項や日付、当事者名を、1ページずつめくらずに検索で見つけられます。

総務・文書管理の担当者

スキャンした書簡、請求書、申込書のフォルダを、共有ドライブや文書管理システムで実際に検索できるPDFに変えられます。

研究者・学生

スキャンした書籍の章、史料、古い学位論文から、打ち直さずに引用をコピーできます。ページの画像もそのまま残ります。

経理・会計の担当者

スキャンした取引明細や領収書から、金額や参照番号を検索できます。数字はページから1桁ずつ写し取られます。

人事・労務の担当者

署名済みの内定通知書や入社手続きの書類を、署名が見える状態のまま、検索可能なPDFとして保管できます。

スマートフォンでスキャンする方

手紙、お知らせ、申込書をスマートフォンで撮影すれば、ただの写真ではなく、検索もコピーもできるPDFが手に入ります。

PDF OCRに関するよくある質問

PDFのOCR化とは何ですか?
スキャンしたPDFの中身はページの画像なので、検索したりコピーしたりできるテキストが入っていません。PDFのOCR化とは、OCRでその画像を読み取り、文字が本物のテキストデータになった新しいPDFを作ることです。「PDFを検索可能にする」「スキャンしたPDFの文字認識」と呼ばれることもあります。
PDFを検索可能にするにはどうすればよいですか?
このページでスキャンをアップロードし、「検索可能なPDF」を選択したまま、ページの読み取りが終わったら結果をダウンロードしてください。Word などのソフトから書き出したPDFは、通常すでにテキスト検索できるようになっています。このツールは、中身が実際にはスキャンや写真であるPDFを対象としています。
写真、ロゴ、印影、署名はどうなりますか?
スキャンから切り出し、ページ上の元の位置に戻します。手書きの署名は文字として打ち直されず、署名の画像のまま残るため、署名や押印のある書類でも、通常は署名と印影がそのまま表示されます。
インストールせずに、オンラインでPDF OCRを使えますか?
はい。Linnk はパソコンでもスマートフォンでもブラウザ上で動作するため、インストールは不要です。スキャンをアップロードし、ページが変換されていく様子を確認しながら、アカウントを作成する前に検索可能なPDFをプレビューできます。
スキャンしたPDFのOCR精度はどのくらいですか?
まっすぐで明るく、鮮明なスキャンほどよく読み取れます。数字、日付、ID は1桁ずつ写し取り、判別しにくい数字は「?」、読めない箇所は推測せずに [illegible] で示します。薄いページ、反ったページ、ぼやけたページは、軽く確認していただくと安心です。
どのファイルをアップロードできますか?
PDF(スキャンしたPDF・デジタルPDF)、JPG、PNG、WEBP、HEIC、HEIF に対応しています。写真は1ページ分のスキャンとして扱われます。Word、PowerPoint、Excel のファイルはすでにテキストを含んでいるため、このツールでは受け付けていません。
OCRはどの言語に対応していますか?
OCRを支えるAIモデルは、広く使われている言語と文字の多くを読み取れます。検索可能なPDFは文書が書かれた言語のまま出力されるため、英文の契約書は英語のPDFとして返ってきます。
Word、Markdown、プレーンテキストで受け取ることはできますか?
はい。同じ変換で、検索可能なPDFと一緒に Markdown、プレーンテキスト、レイアウト再現のスプレッドシートが作成され、Word ファイルもご依頼に応じて数分で作成できます。スキャンに表が含まれている場合は、表のスプレッドシートや CSV も選べます。
スキャンしたPDFのOCRにはどのくらい時間がかかりますか?
通常は1ページあたり1分未満で、一般的なスキャンなら30秒前後です。処理中は所要時間の目安が分単位で表示されます。Word ファイルは変換後に作成するため、さらに数分かかります。
PDF OCRは無料で使えますか?文書の長さに制限はありますか?
プレビューはアカウントなしで無料、認識したテキストのコピーはいつでも無料です。検索可能なPDFやその他のファイルのダウンロードには無料アカウントが必要です。文書の最初のページは無料で変換でき、それより長い文書は linnk.ai/pricing の有料プランでご利用いただけます。
ファイルのプライバシーは守られますか?
ファイルは暗号化された接続で送信され、変換後のファイルは72時間後に自動的に削除されます(結果ページにもその旨が表示されます)。必要なファイルはその前にダウンロードしてください。オンラインツール全般に言えることですが、機密性の高い文書をアップロードする前に、所属する組織の規定をご確認ください。

スキャンしたPDFを、本物のテキストを持つPDFに

スキャンやスマートフォンの写真をドロップして、登録前に検索可能なPDFをプレビューできます。