PDFの座標表からSIMAへ。「座標OCR」を作りました
地積測量図や道路境界確定図の座標を、普段使っているCADへ持っていきたい。
いろいろ試行錯誤してきた方も多いと思います。スキャナーのOCR、ExcelのOCR、Doclingを使ったOCR、スマホのOCR……。
なかなか、うまくいきません。
では、クラウドAIに図面をそのまま投げてみる。これも思いのほか、うまくいかない。(最新のモデルなら、いけそうですが……。)
画像をいろいろ加工しなければならないし、プロンプトを考えるのも面倒です。
AIエージェントが進化したおかげで、ローカルLLMのテストもはかどるようになりました。軽量LLMのGLM-OCRは、座標表の読み取りにある程度使えるめどが立ち、CPUや内蔵GPUでの動作も確認できました。
で、またCodex様のお力を借りて、PDFの切り抜き、OCR、確認・修正、SIMA出力までを一つの画面で行うアプリを作りました。名前は、そのまま「座標OCR」です。
WORKFLOWPDFを切り抜き、読み取り、確認して出力する
使い方は、PDFを開いて座標表を囲み、「切り抜き」を押すところから始まります。別のページや別のPDFから、続けて表を追加することもできます。
読み取る画像を選んでOCRを実行すると、点名・X座標・Y座標の一覧が表示されます。原画像を横に表示しているので、元の表と見比べながら確認し、必要な箇所を修正します。修正した内容は「修正を反映」を押したときに保存されます。
点名の先頭へ同じ文字を付ける機能や、K1、K2……、あるいはK15、K16……のように連番へ変更する機能も付けました。最後に、確認した座標をSIMAファイルとして出力します。SIMAに対応したCAD・測量ソフトへの受け渡しを想定しています。
LOCAL AIインストールせず、PCの中で読み取る
Windows 11の64bit環境向けで、ZIPを展開してEXEを起動する形にしました。PythonやOllama、Excelなどを別途インストールする必要はありません。
モデルと推論エンジンを同梱しているため、ダウンロード後のPDF処理、OCR、SIMA出力はオフラインで利用できます。読み取る画像を外部のAIサービスへ送信する方式ではありません。
初期設定はCPUです。対応するGPUがある場合は、NVIDIA GPU向けのCUDAや、内蔵GPUなどで利用できるVulkanへ切り替えられます。処理時間はPCの構成や表の内容によって変わりますので、まずは小さな表から試していただければと思います。画面は日本語と英語に対応しています。
いくら軽量モデルでも、ローカルAIの処理はPCに大きな負荷をかけます。CPU・内蔵GPU・専用GPUでのテスト結果や、配布ページの推奨環境をよく読んだうえで、ご自身のPCで試してみてください。
CHECKOCRの結果は、元の表と確認してください
点名・X座標・Y座標の3列の表を対象としています。たとえば、複数のPDFに分かれた座標表を取り込み、必要な画像を選んで確認し、SIMAへまとめるような使い方ができます。
ただし、OCRなので読み間違いはあります。数字の桁、小数点、マイナス符号、点名などは、元資料との照合が欠かせません。入力の手間を減らすための補助として使い、業務上重要な判断を、このアプリの結果だけで行わないようにしてください。出力したSIMAも、読み込み先のソフトで確認をお願いします。
今回はv1.0の正式版として公開します。使用期限は設けていませんが、利用環境やPDF・画像の内容によって正常に動作しない場合があります。気になる点がありましたら、配布ページの問い合わせ欄からお知らせください。
DOWNLOADダウンロードと詳しい使い方
動作環境、ダウンロード後の手順、注意事項は、次の公式配布ページにまとめました。更新版もこちらから案内します。
座標OCRの公式配布ページへ