日々徒然(趣味や仕事、地域「取手市周辺」の話題)

PDFの座標表からSIMAへ。「座標OCR」を作りました

PDFの座標表からSIMAへ。「座標OCR」を作りました

PDFの座標表からSIMAへ。「座標OCR」を作りました

地積測量図や道路境界確定図の座標を、普段使っているCADへ持っていきたい。

いろいろ試行錯誤してきた方も多いと思います。スキャナーのOCR、ExcelのOCR、Doclingを使ったOCR、スマホのOCR……。

なかなか、うまくいきません。

では、クラウドAIに図面をそのまま投げてみる。これも思いのほか、うまくいかない。(最新のモデルなら、いけそうですが……。)

画像をいろいろ加工しなければならないし、プロンプトを考えるのも面倒です。

AIエージェントが進化したおかげで、ローカルLLMのテストもはかどるようになりました。軽量LLMのGLM-OCRは、座標表の読み取りにある程度使えるめどが立ち、CPUや内蔵GPUでの動作も確認できました。

で、またCodex様のお力を借りて、PDFの切り抜き、OCR、確認・修正、SIMA出力までを一つの画面で行うアプリを作りました。名前は、そのまま「座標OCR」です。

PDFを切り抜き、読み取り、確認して出力する

使い方は、PDFを開いて座標表を囲み、「切り抜き」を押すところから始まります。別のページや別のPDFから、続けて表を追加することもできます。

読み取る画像を選んでOCRを実行すると、点名・X座標・Y座標の一覧が表示されます。原画像を横に表示しているので、元の表と見比べながら確認し、必要な箇所を修正します。修正した内容は「修正を反映」を押したときに保存されます。

点名の先頭へ同じ文字を付ける機能や、K1、K2……、あるいはK15、K16……のように連番へ変更する機能も付けました。最後に、確認した座標をSIMAファイルとして出力します。SIMAに対応したCAD・測量ソフトへの受け渡しを想定しています。

インストールせず、PCの中で読み取る

Windows 11の64bit環境向けで、ZIPを展開してEXEを起動する形にしました。PythonやOllama、Excelなどを別途インストールする必要はありません。

モデルと推論エンジンを同梱しているため、ダウンロード後のPDF処理、OCR、SIMA出力はオフラインで利用できます。読み取る画像を外部のAIサービスへ送信する方式ではありません。

初期設定はCPUです。対応するGPUがある場合は、NVIDIA GPU向けのCUDAや、内蔵GPUなどで利用できるVulkanへ切り替えられます。処理時間はPCの構成や表の内容によって変わりますので、まずは小さな表から試していただければと思います。画面は日本語と英語に対応しています。

いくら軽量モデルでも、ローカルAIの処理はPCに大きな負荷をかけます。CPU・内蔵GPU・専用GPUでのテスト結果や、配布ページの推奨環境をよく読んだうえで、ご自身のPCで試してみてください。

OCRの結果は、元の表と確認してください

点名・X座標・Y座標の3列の表を対象としています。たとえば、複数のPDFに分かれた座標表を取り込み、必要な画像を選んで確認し、SIMAへまとめるような使い方ができます。

ただし、OCRなので読み間違いはあります。数字の桁、小数点、マイナス符号、点名などは、元資料との照合が欠かせません。入力の手間を減らすための補助として使い、業務上重要な判断を、このアプリの結果だけで行わないようにしてください。出力したSIMAも、読み込み先のソフトで確認をお願いします。

今回はv1.0の正式版として公開します。使用期限は設けていませんが、利用環境やPDF・画像の内容によって正常に動作しない場合があります。気になる点がありましたら、配布ページの問い合わせ欄からお知らせください。

ダウンロードと詳しい使い方

動作環境、ダウンロード後の手順、注意事項は、次の公式配布ページにまとめました。更新版もこちらから案内します。

座標OCRの公式配布ページへ
その他