
OCRの誤認識を確認する
OCRは画像から文字を取り出す補助技術であり、結果が原資料と一致するとは限りません。氏名、金額、日付、否定表現の一文字違いが意味を変えることがあります。
最初に整理すること
OCRは画像から文字を取り出す補助技術であり、結果が原資料と一致するとは限りません。氏名、金額、日付、否定表現の一文字違いが意味を変えることがあります。TreeeSにOCR機能があるという説明ではなく、事務所でOCRを使って資料を準備する際の点検方法です。
具体的な準備手順
元画像を保存し、OCR後のファイルと区別します。機密資料を処理する前に、使うツールの保存先や外部送信の有無を確認します。検索用の文字層を付けるのか、抽出テキストを別書面へ引用するのかによって、必要な確認の深さを分けます。
担当者が確かめるポイント
重要な数値、固有名詞、条番号、表の対応を元画像と照合します。縦書き、手書き、かすれた印字、複数段組みは特に誤認識しやすい箇所です。検索で見つからないことを記載がない証拠とせず、画像の該当箇所を確認します。引用に使う文字は文脈も含めて点検します。
例外が起きたときの扱い
誤りが多い資料はOCRの再処理を繰り返すより、画像での確認や手作業による参照表の作成を検討します。訂正した抽出テキストを原資料そのものと混同しないよう表示します。OCR後にPDFの見た目が変わっていないかも確認し、元の証拠性を損ねる編集を避けます。
具体例で点検する
人名の旧字体、口座番号のゼロ、金額の桁区切りを重点的に原画像と照合します。検索に使うOCR文字列を修正しても、証拠画像の文字を改変したことと混同しないよう処理内容を残します。
公開された暫定マニュアルとの照合
裁判所のセルフトレーニング環境で公開された当事者用操作マニュアルVer.2.0(2026年8月31日発行、暫定版)の本文71、109ページでは、次の点を確認できます。確認画面の初期入力や記載例も提出者自身で点検するよう注意されています。準備書面の主張欄へPDFをアップロードすると、フォームへ入力した主張は削除され、当事者情報等と一体の帳票になる説明があります。手元のPDFだけでなく最終的に形成された書面を読み、両方の主張が残ると思い込まないよう確認します。この説明は訓練用の公開資料に基づくもので、全裁判所・全手続での本番利用開始を示すものではありません。
実務チェック
- 元画像を保存する
- 処理先を確認する
- 固有名詞と数値を照合する
- OCRテキストと原資料を区別する
出典・参照資料
資料に記載された計画・制度と、本記事の実務提案は区別してお読みください。
- 最高裁判所:TreeeS・RoootS追加機能改修の調達資料(構想・改修要件の確認用。以下の実務提案はAILEX編集部による) ↗
- 裁判所:TreeeSセルフトレーニング環境・ヘルプ掲載の当事者用操作マニュアル Ver.2.0(2026年8月31日発行、暫定版)、本文71、109ページ。2026年10月10日確認 ↗
あわせて読む
PDFのページ順と欠落を確認する
ファイルが正常に開けても、ページ順が逆だったり、途中が欠けていたりすれば資料の理解を妨げます。提出前の点検ではページ総数だけでなく、文書の流れが連続しているかを確認します。
記事を読む 書類・証拠提出縦横混在の資料を読みやすく整える
縦長の文書に横長の表や写真が混ざると、読む人が何度も回転操作を行うことになります。提出用PDFでは向きと表示を整えると理解しやすくなりますが、元資料の内容や縮尺を無条件に変えてよいわけではありません。
記事を読む 書類・証拠提出PDFの容量を減らす前に判読性を確保する
ファイルが大きい場合も、圧縮率だけを上げると小さな文字や押印が読めなくなります。TreeeSの容量上限は正式な案内で確認し、mintsの数値をそのまま流用しません。
記事を読む