スキャン書類をAI文字認識で自動化|領収書・請求書の抽出手順
PR・アフィリエイトについて
当サイトはアフィリエイトプログラムを利用しており、紹介リンク経由での申込により報酬を得る場合があります。記事内で紹介するサービスには筆者が実際に使用しているものと、客観情報として比較掲載しているもの(未使用・PR表記あり)が含まれます。
結論
スキャン書類の文字認識は、スマホで撮影→ChatGPTまたはClaudeに貼り付けるだけで今すぐ始められる。専用ソフトは不要。領収書なら金額・日付・店名を10秒以内に抽出でき、Googleスプレッドシートへの転記も自動化できる。
月末の経費精算で、領収書をひとつひとつ手入力している人はいないだろうか。
実際に自分もしばらくそれをやっていた。20枚・30枚の領収書を見ながら、金額・日付・店名をスプレッドシートに打ち込む。ミスタイプして後で差異が出る。あの作業は、実は今すぐゼロにできる。
この記事では、スキャン書類をAIで文字認識する具体的な手順を、ツール別に整理する。エンジニアでなくても、スマホとChatGPTかClaudeがあれば今日から使える内容だ。
なぜ手入力は非効率なのか#
単純に時間の問題だけではない。「金額を見て→キーを押す→次へ」の反復作業は集中力を削る。1件5秒でも、100件で500秒(約8分)。見落としリスクも本人の疲労に比例して上がる。
しかも、ほとんどの数字は印字されている。印字されているなら機械に読ませればいい。それが文字認識(OCR)の発想だ。
メモ
OCR(Optical Character Recognition)= 画像中の文字を機械が読み取る技術。AIが画像を解析して「この黒い領域はひらがなの『と』」と判断する。スマホカメラの精度向上と生成AIの組み合わせで、2024年以降は精度が格段に上がった。
AIが書類から自動抽出できる項目#
| 書類の種類 | 抽出できる主な項目 |
|---|---|
| 領収書 | 金額・日付・店名・消費税額・支払方法 |
| 請求書 | 請求金額・期日・請求元社名・品目・合計 |
| 名刺 | 氏名・会社名・電話・メール・住所 |
| 契約書(印刷物) | 金額・日付・当事者名・期間 |
| 納品書 | 品名・数量・単価・合計 |
ただし手書きの文字は認識精度が下がる。特に崩した文字や細いペン書きは読み違えることがある(後述)。
方法1:ChatGPT(GPT-4o)で書類を読ませる#
最も手軽な方法。スマホのChatGPTアプリで完結する。
手順
- ChatGPTアプリを開き、新規チャットを作成する
- 画像ボタン(📎)をタップし、領収書の写真を選択またはその場で撮影
- 以下のプロンプトを入力して送信する
この領収書から以下の項目をJSON形式で抽出してください。
- date(日付: YYYY-MM-DD形式)
- amount(税込合計金額: 数値のみ)
- vendor(相手先・店名)
- tax(消費税額: 数値のみ、不明なら null)
- category(勘定科目の推定: 例 "交際費" "消耗品費" など)
- 返ってきたJSONをGoogleスプレッドシートに貼り付ける
- スプレッドシート側で
=IMPORTJSON()やGASで自動取り込みするか、手で各セルに転記する(後述のGASテンプレが楽)
複数枚をまとめて処理したい場合は、写真を複数枚添付して「すべての領収書について同じJSON形式で配列として返してください」と指示すると、一括で返してくれる。体感で10枚程度なら精度が落ちにくい。
方法2:Claude(claude.ai)で読ませる#
ClaudeもGPT-4o同様に画像分析ができる。自分がよく使う組み合わせは Claude + Googleスプレッドシート だ。
ClaudeはGPT-4oより「表の読み取り」が若干丁寧な印象がある(個人的な体感であり、精度を保証するものではない)。請求書のように列が複数ある書類は、Claudeに投げると行・列の対応を崩さずに返してくれることが多い。
プロンプトの例:
添付の請求書を読み取り、以下の形式のMarkdown表で出力してください。
| 品目 | 数量 | 単価 | 小計 |
明細が複数行ある場合はすべて出力してください。最後に合計行を追加してください。
Markdown表で返ってくると、そのままスプレッドシートに貼り付けできる。
メモ
Claude.aiの無料プランでも画像添付は可能(2026年10月時点)。ただし1会話あたりの上限があるため、大量処理はAPIまたはClaudeのProプランが現実的。
方法3:Googleドライブの自動OCR#
ファイルをドライブにアップロードするだけで、Googleが文字認識してくれる方法がある。
手順
- GoogleドライブをPCブラウザで開く
- PDFまたは画像ファイル(JPEG・PNG)をドラッグ&ドロップでアップロード
- アップロードされたファイルを右クリック →「アプリで開く」→「Googleドキュメント」を選択
- 自動でOCR処理が走り、文字がテキストとして抽出されたGoogleドキュメントが開く
- テキストをコピーして、ChatGPTかClaudeに「この内容から経費項目をCSVで整理して」と投げる
この方法の利点は無料・追加ツール不要な点。欠点は、抽出テキストのレイアウトが崩れやすいこと(特に表形式の書類)。複雑なフォーマットの請求書なら方法1か2の方が精度が出やすい。
精度を上げるための撮影コツ#
どの方法でも、元画像の品質が認識精度を左右する。
メリット
- 明るい場所(窓際・蛍光灯の真下)で撮影する
- 書類を平らな面に置く(丸まったり折れていない状態)
- カメラを書類に対してなるべく垂直に構える
- 解像度はスマホのデフォルト設定(1200万画素以上)で十分
- レシートは背景と色が対比する台(白い紙の上に黒いレシート等)に置く
デメリット
- 影が入ると金額の「1」と「7」が誤認識されやすい
- 手書き部分は認識率が下がる(特に金額の修正印など)
- 感熱紙レシートは経年劣化・折り目で文字が薄くなりやすい
- 斜め45度以上傾いた画像は歪み補正が効きにくい
感熱紙レシートは半年〜1年で文字が薄くなる。月末にまとめて処理するより、もらったその日に撮影するのが確実だ。
Googleスプレッドシート連携を自動化する(GASで転記)#
毎回コピペするのが手間ならGoogle Apps Script(GAS)で自動化できる。
例えば以下のようなスクリプトをChatGPTやClaudeに「作って」と頼むと数分で書いてくれる:
以下をGASで実装してほしい。
- A列にJSON文字列が貼られたら自動でパースし、
B列: date, C列: amount, D列: vendor, E列: category に分けて入力する
- JSONはChatGPTが返す形式(date/amount/vendor/tax/category のキー)
これを設定しておけば、A列にJSONを貼るだけで残り4列は自動で埋まる。
向き不向き#
注意
AI OCRは「素早く大量に抽出する」用途に向いている。確認なしに会計ソフトへ直接入力するのは危険。金額の最終確認は人間が必ず行うこと。
向いているケース
- 経費精算の一次入力(後で確認前提)
- 大量の名刺をデータベース化する
- 古い紙書類をデジタルアーカイブ化する
- 複数書類から同じ項目(日付・金額)だけを一括で引き出す
向いていないケース
- 消えかけた文字・古い感熱紙レシート
- 全て手書きの書類
- 法的に正確性が求められる契約書の条文読み取り(確認必須)
- 印影・捺印の有無の確認(機械では判断しにくい)
AIで書類の文字認識をさらに効率化するなら#
スキャンOCRと同じ「AIが音声・テキストを自動で認識する」技術は、会議の議事録作成にも応用されている。書類のOCRで自動化の手応えを感じたなら、音声→テキストの自動化も組み合わせると、日々の事務作業をまとめて省力化できる。
PRおすすめAI議事録・文字起こしツール(giji)会議録音→自動文字起こし→要点まとめまでAIが処理。書類OCRと組み合わせると、事務作業のインプット全体をAIに任せられる。まとめ#
スキャン書類の文字認識は、スマホとChatGPTかClaudeがあれば今日から無料で始められる。
| 方法 | 手軽さ | 精度 | 向いている書類 |
|---|---|---|---|
| ChatGPT(GPT-4o)画像添付 | ◎ | ◎ | 印刷レシート・領収書 |
| Claude 画像添付 | ◎ | ◎ | 表形式の請求書・明細 |
| Googleドライブ OCR | ○ | △(表は崩れやすい) | シンプルな文書・PDF |
大切なのは「完璧を求めすぎない」こと。90%が自動化されれば、残り10%の確認は人間が行う。それだけで月末の手入力作業は体感で数分の1になる。
まずは手元の領収書1枚をスマホで撮り、ChatGPTに貼り付けてみるところから始めてほしい。
よくある質問#
認識結果に誤りがあった場合、どう修正すればいいですか?#
AIが返した値をそのままスプレッドシートに取り込まず、まず目視で確認する運用が安全。特に「金額の桁」と「日付の年」は誤認識が起きやすい。修正はスプレッドシート上で手動で行い、元書類の画像も同じフォルダに保存しておくと後から照合しやすい。
個人情報や機密書類をAIに送っても大丈夫ですか?#
ChatGPTの有料プラン(Plus/Team)やClaudeのProプランは、入力データをモデル学習に使わない設定が選べる。ただし無料プランでは設定を確認する必要がある。社外秘書類・マイナンバー含む書類は社内セキュリティポリシーを確認してから運用してほしい。企業利用はAPIキー+自社環境での処理も選択肢のひとつ。
まとめて50枚以上を処理したい場合はどうすればいいですか?#
ChatGPTやClaudeのAPIを使い、Python等で「画像ファイルを順に読み込んで抽出→CSVに追記」するスクリプトを作ると、ボタン1つで一括処理できる。スクリプトの作り方自体もChatGPTやClaudeに「書いて」と頼めば動くコードを返してくれる。月50枚以上の処理が定常化しているなら、API料金(数百円〜/月)を払って自動化する価値が十分にある。