導入準備・実務提案
レックスくんがご案内

OCRを使って記録を読むときの注意点

画像記録を文字化すると探索や要約がしやすくなりますが、OCRには読み誤りがあります。元画像を基準に、重要な数字や固有名詞を確認し、変換データを安全に扱うための考え方を示します。

OCRの目的を限定する

検索しやすくするための文字化と、引用文を作るための文字化では確認の深さが違います。探索用のテキストは誤字があっても候補を見つける助けになりますが、そのまま証拠内容として引用しません。TreeeS自体のOCR機能を前提とせず、所内で加工する場合の準備として扱います。

誤読しやすい箇所を重点確認する

金額、年月日、割合、氏名、印影の近く、手書き部分、表の列は読み違いが生じやすい箇所です。特に表の数値は、文字が正しくても対応する項目がずれることがあります。抽出文だけを読む工程と、原画像へ戻って意味を確認する工程を分けます。

処理先の情報管理を確認する

外部サービスへ記録を送る前に、利用目的、保存、学習への利用、アクセス権、削除方法などを契約や設定で確認します。無料で手軽という理由だけで秘密情報を送らないようにします。所内承認済みの環境を定め、利用者が毎回独自の変換先を選ばない運用を提案します。

成果物を原資料と結び付ける

OCRテキストには元資料の識別子と処理日を付けます。修正した場合は、重要な修正箇所と確認者を記録すると後から検証できます。文字化できなかったページを一覧にしておけば、検索対象から漏れている部分が分かり、資料全体を読んだと誤認することを防げます。

OCRの訂正履歴を残す

「一」と「ー」、漢数字と算用数字、桁区切りの読み違いは検索漏れや金額誤認につながります。OCR文字列を修正する場合は原画像を保存し、修正箇所と確認者を記録します。検索用テキストの訂正で、提出済み文書そのものを直したことにはなりません。読めない部分を文脈で補完するより「判読未了」と残し、別の鮮明な資料や正式な照会で確かめる方が、後の起案で未確認情報が事実化するのを防げます。

公式資料で確認する範囲

自己研修サイトで公開されている当事者用操作マニュアルVer.2.0(2026年8月31日発行、暫定版)の本文152–156頁では、ファイル詳細からの取得はタブごとの処理で、本体と詳細情報は別ファイルとして出力されます。一覧からはPDF結合や詳細情報の有無を選択します。電子署名付きデータは結合や詳細情報付加によって署名を検証できなくなる可能性があるため、同資料は結合なし・詳細情報なし、又は詳細画面からの個別取得を案内しています。これは2026年10月10日に確認した研修用の資料に基づく説明です。本番の適用対象・最新画面は利用時点の裁判所の案内で確認してください。

実務チェック

  • OCRの利用目的を決める
  • 数字と表を原画像で照合する
  • 外部処理の条件を確認する
  • 未処理ページを記録する

出典・参照資料

資料に記載された計画・制度と、本記事の実務提案は区別してお読みください。

編集方針・出典の扱い

あわせて読む

AILEX / 検証可能なAIリーガルOS

便利さの、その先へ。
AIの判断に、確かめられる根拠を。

mints・TreeeSの情報収集から、日々の法務でのAI活用まで。
機密情報の取り扱いと、根拠・判断履歴の検証を大切にします。

AILEXのTreeeS対応方針を見る →