スキャンPDFの文字をコピーする方法|OCRで文章を取り出す手順と注意点

PDFの文字をドラッグしても選べない。コピーしたいのにページ全体が画像として扱われる。紙をスキャンしたPDFでは、見た目に文字があっても、文字データが入っていないことがあります。

この記事では、画像になっている文字をOCRで読み取り、文章をコピーしたり検索したりする方法を説明します。無料で文章を取り出したい場合と、元の見た目を残した検索可能なPDFを作りたい場合で、選ぶ方法が異なります。

公式資料の確認日:2026年10月9日。Google・Adobeの公式手順をもとに整理しています。各端末での操作実測や認識精度の比較ではありません。画面・対応機能・利用条件は変更される場合があります。

文章を取り出すならGoogleドキュメント、PDFのまま検索したいならOCR対応ソフト

目的を先に決めましょう。Googleドキュメントで取り出した文章は、元のPDFのレイアウトがそのまま再現されるものではありません。どちらの方法でも、認識後の数字や固有名詞を原文と照合します。

最初に確認:スキャンPDFが原因とは限らない

  1. PDFを端末で開き、本文の一部分を選択してコピーします。
  2. メモ帳などに貼り付け、文字が正しく出るか確認します。
  3. ファイル内検索で、見えている単語を検索します。

文字が選べず検索にも出ないなら、画像だけのPDFの可能性があります。ただし、コピーの権限制限、フォントや文字コードの問題も考えられます。制限された資料は、権限を確認して作成者に相談してください。

文字をコピーできるのに順番や内容が崩れる場合は、まず元のWordなどからPDFを作り直せるか確認します。OCRは、すべてのコピー問題を解決する機能ではありません。

OCRとは?圧縮やPDF変換との違い

OCRは、画像の中の文字を認識してテキストにする処理です。容量を減らす「圧縮」や、画像をPDFとして保存する操作とは別です。

作業 目的
PDF圧縮 ファイル容量を減らす。文字データが追加されるとは限らない。
画像をPDFにする 画像をPDF形式の資料にまとめる。OCRなしでは画像のままの場合がある。
OCRで文章を取り出す 認識した文字を、コピーや編集に使う。
検索可能なPDFを作る ページ画像に検索用のテキストを持たせ、PDF内の文字を探せるようにする。

方法1:Googleドライブで文章を取り出す

パソコンでGoogleドライブを使い、PDFをGoogleドキュメントで開いて文字を取り出す方法です。Googleの公式資料では日本語も対応言語に含まれています。以下はパソコン向けの手順です。

準備するファイル

公式の準備案内は、PDFやJPEG・PNG・GIFを対象とし、容量2MB以下、文字の高さ10ピクセル以上、正しい向き、鮮明で明るさが均一な画像を勧めています。2MBという条件は、Googleドライブ全体の保存容量上限ではなく、この変換の準備に関する案内です。

  1. 送信してよいPDFをGoogleドライブへアップロードします。
  2. パソコンでGoogleドライブを開き、対象ファイルを右クリックします。
  3. 「アプリで開く」から「Googleドキュメント」を選びます。
  4. 取り出された文章を読み、原文と比較します。
  5. 確認した文章をコピーして、必要な文書へ貼り付けます。

表、段組み、脚注、リストなどは正しく認識されない場合があります。元の見た目を保ったPDFが必要なら、次の方法を検討してください。

資料はGoogleのサービスへ送信されます

社外秘や個人情報を含む資料は、アップロードしてよいかを確認します。会社の資料では組織のルールを優先してください。

方法2:Acrobatで検索可能なPDFを作る

Adobe AcrobatのOCR機能を使う方法です。閲覧用Readerがあれば同じ機能を無料で使える、という意味ではありません。利用中の製品・契約で「スキャンとOCR」を使えるか確認し、購入が必要なら条件を確認してから進めます。

  1. 原本のバックアップを残し、作業用のコピーをAcrobatで開きます。
  2. 「すべてのツール」から「スキャンとOCR」を開きます。
  3. 「このファイル内」を選び、処理するページ範囲と言語を設定します。
  4. 必要な設定を確認し、「テキスト認識」を実行します。
  5. 処理後のPDFを別名で保存し、文字選択と検索を試します。

公式案内では、処理によって検索可能なテキストレイヤーが作られます。認識結果を点検し、誤りがあれば修正や設定を変えた再処理を行います。元の画像が読めても、検索用テキストが間違っている場合があるため、両方を確認しましょう。

認識後に必ず見る5つのポイント

  • 数字と記号:0とO、1とl、マイナス、小数点、桁区切り。
  • 金額と日付:万円と円、年・月・日、締切、単位。
  • 名前と用語:人名、会社名、専門用語。
  • 読む順番:段組み、縦書き、見出しと本文の混在。
  • 表と注記:列と行の対応、対象外の条件、脚注。

確認は、認識した文章を見直すだけでなく、元ページと並べて行います。重要な情報は一文字ずつ確かめ、読めない箇所を推測で埋めないようにします。

うまくいかないときの対処

容量が大きい

必要なページだけ取り出す方法を先に検討します。PDF圧縮も選択肢ですが、強い圧縮で文字がつぶれると読み取りに不利です。元の資料を残して比較してください。

文字がぼやける・傾く

可能なら鮮明な原本を再取得・再スキャンします。ページの向き、影、文字の切れを見直し、処理後に確認してください。手書きや複雑なレイアウトは、人の修正が必要になる場合があります。

AIに送っても読めない

OCR後の本文を正しくコピーできるか確認し、必要な範囲をテキストとして渡す方法もあります。ほかの原因の切り分けはPDFをAIに読み込ませられないときの対処法を参照してください。

OCR後の文章をAIで要約するとき

OCRの誤りを残したまま要約すると、間違った数字や条件が要約にも入り得ます。認識結果の点検を先に済ませ、「この本文だけを要約し、不明な文字は推測しないで」と依頼します。

具体的な指示文と原文照合の方法は、AIでPDFを要約する方法にまとめています。OCR後も原本は残し、要約の重要箇所を再確認しましょう。

よくある質問

PDFの見た目が変わらなければOCRは失敗?

見た目を保ち、検索用のテキストを追加する方式もあります。変化の大きさではなく、文字選択・検索・コピー結果で確認します。

OCRで必ず編集できるPDFになる?

いいえ。検索できること、文章をコピーできること、元のレイアウトを編集できることは別です。目的に合う出力を選びましょう。

スマホだけでも同じ操作ができる?

Googleドライブの公式案内は、この変換をパソコンで行う手順です。スマホ向けの別機能を使う場合は、そのアプリの対応・送信先・保存形式を確認してください。この記事のパソコン用手順がそのまま使えるとは限りません。

PDFの道具選びで迷う場合は、無料のPDFツールで足りる用途と、有料ソフトを選ぶ前の7つの確認点もご覧ください。

参考にした公式資料

確認日:2026年10月9日。最新の利用条件は公式案内で確認してください。

コメント

タイトルとURLをコピーしました