画像文字抽出:スキャン画像や写真を、編集できるテキストに
画像文字抽出はどのような仕組みですか?
画像文字抽出とは、ページを写した画像を、コピー・検索・編集できる文字に変えることです。スキャン画像やスマホの写真に入っているのは画素であって文字ではないため、まず何かがそれを読み取る必要があります。Linnkでは、各ページの画像をAIモデル(LinnkはChatGPT、Claude、Geminiのモデルを使用)に送り、モデルがページを読み取って構造化されたテキストとして組み立て直し、読む順番どおりに書き出します。これが効いてくるのは、1〜2行を超える場合です。2段組みの記事、レターヘッドとフッターのある手紙、記入欄の横に項目名が並ぶ申込書、あるいはアラビア語、ヘブライ語、中国語、日本語のページなどです。1文だけならスマホの文字コピー機能のほうが手早く、ページ全体なら、たいていはすべての文字を正しい順番で、ファイルとして手に入れたいはずです。数字、日付、ID、金額は1桁ずつそのまま写します。モデルが読み取れない桁は「?」、読めない箇所は[illegible]と表示し、推測で埋めることはありません。認識したテキストのコピーはいつでも無料で、同じアップロードからWord、Markdown、検索可能なPDFも作成できます。まっすぐで明るく、きれいにスキャンされたページほど読み取りやすく、色あせたページや反ったページは軽く確認することをおすすめします。
Last updated: 2026年9月
画像文字抽出の使い方
スキャンしたページやスマホの写真から、どこにでも貼り付けられるテキストまで3ステップです。
スキャン画像または写真をアップロード
スキャナーの保存フォルダやカメラロールから、JPG、PNG、WEBP、HEICのファイルをドロップします。画像は1枚ずつ1ページのスキャンとして読み取られるため、ページを正面から均一な明るさで撮影してください。出力形式はプレーンテキストがあらかじめ選択されています。
テキストを確認してコピー
通常1分以内に、認識されたテキストがプレビューに表示され、アカウントなしで無料でコピーできます。「?」や[illegible]は画像が薄くて読めなかった箇所なので、元のページと見比べてください。
必要なファイルをダウンロード
テキストファイルのダウンロードには、無料アカウントでのログインが必要です。Markdownと検索可能なPDFは同じ処理から作成され、Wordファイルはご依頼に応じて、さらに数分ほどで作成されます。
この画像文字抽出ツールでできること
手紙、記事、申込書、色あせたコピーまで。ページ全体の画像をテキスト化するために作られたツールです。
ページ全体を読む順番どおりに
2段組みのニュースレター、サイドバーのある手紙、記入欄の横に項目名が並ぶ申込書でも、テキストは人が読む順番で出力されるため、左右の行が交互につながった段落にはなりません。写真から数行ずつ手作業でコピーするとき、いちばん時間がかかるのがこの部分です。
数字は推測せず、そのまま写す
請求書番号、日付、金額、参照コードは1桁ずつそのまま写します。薄くて読めない桁は「?」、読めない箇所は[illegible]と表示されるため、大事な書類に貼り付ける前に、どこを確認すればよいかがわかります。
色あせたスキャンは埋めずに印を付ける
古いコピー、黄ばんだページ、コントラストの低い写真も、印字が読める部分は読み取り、それ以外はもっともらしい推測で埋めずに印を付けます。それでも、まっすぐで明るいスキャンがいちばん読み取りやすいため、反ったページはできれば撮り直してください。
言語はそのまま、または翻訳
元の言語のまま出力することも、同じ処理で翻訳することもできます。初期設定では、アラビア語、ヘブライ語、中国語、日本語、韓国語のスキャンはその文字のままテキストになり、検索や編集にすぐ使えます。別の言語が必要な場合は、開始前に「翻訳先の言語…」を選んでください。
表は表として
ページに表がある場合は、Markdownを選べばMarkdownの表として残せます。スプレッドシートやCSVを選べば、表ごとに1シート、1ファイルで出力されます。表をでっち上げることはなく、表のないページは表がないと表示されます。
Word、Markdown、検索可能なPDFも
同じアップロードから、見出しやリストを含むMarkdownと、本物のテキストとして組み直した検索可能なPDFを作成できます。PDFでは写真、ロゴ、印影が元の位置に戻されるため、見た目は原本に近くなります。Wordファイルはご依頼に応じて作成され、通常は数分で完了します。
画像文字抽出の基本情報
スキャン画像や写真をアップロードする前に知っておきたいこと。
入力
- スキャン画像
- JPG、PNG、WEBP
- スマホの写真
- HEIC、HEIF、JPG
- 画像1枚
- 1ページのスキャンとして読み取り
- 文字体系
- アラビア語、ヘブライ語、CJKを含む
出力
- プレーンテキスト
- ページ全体を読む順番どおりに
- Markdown
- 見出し、リスト、表
- 検索可能なPDF
- 本物のテキストとして再構成
- Word
- ご依頼に応じて作成
精度
- 数字と日付
- 1桁ずつそのまま
- 読めない桁
- 「?」で表示
- 読めない箇所
- [illegible]と表示
- 色あせ・反りのあるページ
- 軽い確認をおすすめ
利用条件
- プレビュー
- 無料、アカウント不要
- テキストのコピー
- いつでも無料
- ダウンロード
- 無料アカウント
- 長い文書
- 有料プラン(linnk.ai/pricing を参照)
画像文字抽出の方法を比較
写真から文字を取り出すよくある方法と、Linnkの違い。
| Feature | Linnk 画像文字抽出 | スマホの文字コピー(カメラ・写真アプリ) | 無料のオンラインOCRサイト | 手入力 |
|---|---|---|---|---|
| 1〜2行のコピー | 使えますが、やや大がかり | 手早く、標準搭載 | 手早く、多くはアカウント不要 | 短い行なら十分 |
| 段組みのあるページ全体 | ページ全体を読む順番どおりに | 手作業で選択してコピー、細切れになりがち | サイトによる。段が混ざることも | 遅いが、順番は自分で決められる |
| 色あせた・コントラストの低いスキャン | 読めない部分は[illegible]と表示 | 場合による | 場合による | 自分の判断次第 |
| 数字と金額 | 1桁ずつそのまま。不確かな桁は「?」 | 目視で確認 | 目視で確認 | 1桁の打ち間違いが起きやすい |
| アラビア語、ヘブライ語、CJKの文字 | それぞれの文字のまま読み取り | 端末の言語設定による | 対応言語はサイトによる | その文字を入力できるキーボードが必要 |
| 得られるもの | テキストファイル、Word、Markdown、検索可能なPDF | クリップボード上のテキスト | 多くはテキスト、Wordの場合も | 入力先のファイル |
| 費用 | コピーは無料、ダウンロードは無料アカウントで | 無料、標準搭載 | 多くは無料、広告や制限がある場合も | 自分の時間 |
2026年9月時点の比較です。他のツールの機能はさまざまで、頻繁に変わります。最新の内容はそれぞれでご確認ください。
画像文字抽出を活用している方
画像の中にあるページの文字を、別の場所で使いたい方に。
事務・総務の担当者
スキャンした手紙、通知、契約書のページをテキストにして、メールや案件ファイル、返信文に貼り付けられます。1段落ずつ打ち直す必要はありません。
学生・研究者
図書館の本や紙の学術誌のページを撮影し、段落をテキストにしてノートや引用に使えます。2段組みのレイアウトも正しい順番で出力されます。
個人事業主・経理担当者
スキャンした請求書やレシートの写真から請求書番号、日付、金額を取り出し、1桁ずつそのまま帳簿に貼り付けられます。不確かな桁には印が付きます。
家系調査・アーカイブ担当者
タイプ打ちの手紙、新聞の切り抜き、色あせたコピーを検索できるテキストに変換します。薄くて読めない箇所には印が付くため、原本と照合すべき箇所がわかります。
外国語の書類を扱う方
アラビア語、中国語、ロシア語などでスキャンされた証明書や公的な書簡を、その言語の文字のまま編集できるテキストにします。検索、引用、翻訳者への受け渡しにすぐ使えます。
教員・講師
印刷したプリントや教科書のページを編集できるテキストにして、授業に合わせて手直しできます。一から作り直す必要はありません。