Mistral AI、最新OCRモデル「Mistral OCR 3」を発表
Mistral AIが文書のテキスト・レイアウト認識を行うOCRモデルの最新版「Mistral OCR 3」をリリースした。複雑な文書構造の解析精度向上が図られている。
Mistral AIが、光学文字認識(OCR)モデルの新バージョン「Mistral OCR 3」を発表しました。同社の公式ブログで公開されており、文書からのテキスト抽出やレイアウト解析を担うモデルとして位置づけられています。
OCRモデルの位置づけ
OCR技術は、スキャンされた文書やPDF、画像内のテキストをデジタルデータとして抽出するために用いられます。近年はテーブルや図表、多言語混在の文書など、複雑なレイアウトを持つ資料への対応が求められており、LLMベースのアプローチによって従来型OCRよりも高精度な構造理解が可能になってきています。Mistral AIはこれまでも文書理解に関するモデルを提供しており、今回の「Mistral OCR 3」はその後継として位置づけられます。
企業文書処理への応用
OCRモデルの改良は、契約書や請求書、レポートなど企業内で扱われる大量の文書をAIで自動処理する用途に直結します。検索拡張生成(RAG)システムやエンタープライズ向けドキュメント処理パイプラインへの組み込みが想定され、Mistral AIのエコシステム内でAPIやプラットフォームを通じて利用可能になるとみられます。
原文ソース
Mistral AI