Skip to main content
FineParser は ABBYY FineReader Engine を基盤としています。これは、ABBYY が 20 年以上にわたりソフトウェアベンダーやインテグレーター向けに提供してきた OCR・文書解析 SDK です。/parse に送信されたすべての文書でテキストを認識し、テーブルを検出し、読み取り順序を判別しているのも、この同じエンジンです。FineParser がそこに加えているのはパッケージングです。具体的には、Docker コンテナー、REST エンドポイント、十分に検証された固定のエンジン設定、そして LLM パイプライン向けに選定された出力形式です。このページは、その土台で何が動いているのかを知りたい方、また一段下のレイヤーに降りてエンジンを直接扱うべきなのはどのような場合かを知りたい方に向けた内容です。

2つの製品の関係

FineParser は、SDK を開く必要が一切ないように、いくつかの判断を代わりに行います。公開されているのは2つの認識モード、3つの出力形式、そして言語設定だけで、それ以外はすべて固定されています。これらの既定値は、構造化データの抽出と高速なテキスト抽出に対してエンジン自体が推奨する構成に基づいています。そのため、FineParser から得られる結果は、ABBYY がこれらのタスク向けに推奨する設定で構成した FineReader Engine が出力する結果と同じです。 FineReader Engine そのものは、お客様のアプリケーションにリンクして使用するライブラリです。Windows、Linux、macOS 上で動作し、C++、C#、.NET、Java、および COM 対応のスクリプト言語から呼び出せます。サービスではなくライブラリであるため、処理パイプラインに固定された部分はありません。画像の前処理からレイアウト解析、認識、エクスポートに至るまで、すべての段階がオブジェクトとプロパティとして公開されており、コードから読み取り、変更できます。

FineParser で十分なケース

RAG パイプラインやエージェント用ツール、ドキュメント取り込みサービスを構築するチームの多くにとって、FineParser 以上のものは必要ありません。PDF や画像を、構造を適切に復元したうえで DocLang、JSON、またはプレーンテキストに変換することが目的であり、それをコンパイル済みの依存関係ではなくコンテナーと HTTP 呼び出しで実現したいのであれば、FineParser が最適なツールです。以降を読み進める必要はありません。

FineReader Engine を検討すべきタイミング

FineReader Engine が適しているのは、課題の性質が、いくつかのパラメーターを指定する単一のエンドポイントでは収まりきらなくなった場合です。具体的には、通常は次のいずれかに該当します。
  • 自社製品に認識機能を組み込んで提供する場合。 FineReader Engine は商用ソフトウェアへの組み込み用にライセンスされており、インプロセスで動作します。そのため、アプリケーションと並べて配置するコンテナーも、ドキュメントごとの HTTP 往復も不要です。
  • FineParser では生成できない出力形式が必要な場合。 エンジンは DocLang、JSON、プレーンテキストに加えて、検索可能な PDF や PDF/A、DOCX、XLSX、PPTX、HTML、ALTO、ABBYY XML、EPUB などへエクスポートできます。Export Formats を参照してください。
  • FineParser の範囲外の認識機能が必要な場合。 これには、1D および 2D のバーコード認識、パスポートや ID カードの機械可読ゾーンの抽出、フォームの手書きフィールド認識 (ICR) 、チェックマーク認識 (OMR) 、名刺の解析、ドキュメント分類、ドキュメント比較が含まれます。エンジンのドキュメントにある基本的な使用シナリオでは、これらを 1 つずつ解説しています。
  • 自社のドキュメントに合わせてパイプラインを調整する必要がある場合。 FineParser のモードは固定です。エンジンであれば、定義済みプロファイルを起点に、前処理、解析、認識、合成の個々のパラメーターを調整できます。これは、特殊なレイアウトや劣化したスキャン、あるいは既定値では十分な精度が出ない限定的な文書タイプを扱う場合に効いてきます。
  • 処理モデルを細かく制御したい場合。 エンジンは、並列処理のためのプリミティブ、ページ単位の反復処理、領域単位の認識、さらにエクスポート前に認識済みレイアウトを確認・編集する手段を提供します。一方、FineParser はドキュメント全体を処理して結果を返すだけです。
FineParser の手軽さを保ちつつエンジンレベルの調整も行いたい場合は、SDK 統合に踏み切る前に FineParser Enterprise を検討してください。Enterprise はコンテナーと REST API をそのままに、エンジンの処理設定を開放するため、エンジン API に対してコードを書かなくても自社のドキュメントに合わせて認識を調整できます。

ライセンス

FineReader Engine は FineParser とは別にライセンスが提供されます。FineParser のプランには FineReader Engine の開発者ライセンスもランタイムライセンスも含まれておらず、両者を相互に利用することはできません。エンジンは ABBYY の営業部門および Partner を通じて販売され、ページ単位、コア単位、オンラインといったライセンスオプションが用意されています。各オプションの仕組みについては、エンジンのドキュメントの ライセンス をご覧ください。ユースケースに関するご相談は ABBYY へのお問い合わせ からお願いいたします。

詳細情報

FineReader Engine 12 のご紹介

エンジンでできること、主な機能、ドキュメントの構成について説明します。

基本的な使用シナリオ

データ抽出、テキスト抽出、変換、アーカイブなどの実装方法を手順を追って解説します。

プロファイルの操作

定義済みプロファイルと、独自の構成を作成する方法について説明します。

API reference

エンジンに含まれるすべてのオブジェクト、インターフェイス、メソッド、列挙体を掲載しています。