フランスのMistral AIが発表した「Mistral OCR」は、画像やPDFから高精度でテキストを抽出し、Markdown形式で出力できる革新的なAPIです。
特に複雑なレイアウトの文書にも対応し、情報の整形が自動化されることで、文書管理が大幅に効率化される可能性があります。
これは、企業の生産性向上に寄与し、さまざまな業界での利用が期待されます。
記事の概要
フランスのスタートアップ企業Mistral AIが、光学文字認識(OCR)技術を活用したドキュメント理解API「Mistral OCR」を発表しました。
このサービスでは、画像やPDFからテキストや画像を抽出し、文書の構造を維持したままMarkdown形式で出力することが可能です。
特に、複雑なレイアウトや多様な文書形式に対応しており、見出しや箇条書き、表などの構成情報を自動的に付与します。
Mistral OCRは、他の主要なOCRモデルに比べて優れた性能を示し、毎分最大2,000ページの高速処理を実現しています。
価格は1,000ページあたり1ドルで、APIは「la Plateforme」を通じて利用でき、無料試用も可能です。
今後の展開として、クラウドやオンプレミス環境でのサービス提供も計画されています。
記事のポイント
- 高度なOCR技術: Mistral OCRは、複雑なレイアウトやマルチモーダルドキュメントにも対応しており、高度な構造解析を実現しています。
- Markdown出力機能: 文書の構造を保持し、Markdown形式で出力できるため、ドキュメント管理システムへの組み込みが容易です。
- 迅速な処理速度: 毎分最大2,000ページの高速処理を実現し、業務効率を大幅に向上させることが可能です。
詳しい記事の内容はこちらから(引用元)
フランスのAIスタートアップ企業のMistral AI(ミストラルAI)は、光学文字認識(OCR)技術を用いたドキュメン…
https://www.watch.impress.co.jp/docs/news/1668453.html