Skip to main content
FineParser は、解析した各ドキュメントを 3 種類の形式のいずれかで返します。これらの形式は、ドキュメントの構造をどの程度保持するか、そしてそれをどのようにエンコードするかが異なります。

出力形式の設定

リクエストごとに outputType field を指定します。既定値はないため、すべてのリクエストで形式を明示する必要があります。認識モードや言語とは異なり、形式はリクエスト単位で選択できるため、1つのコンテナーで3種類すべてに対応できます。
送信するとジョブIDが返されます。REST API の説明に従って、ジョブをポーリングし結果をダウンロードしてください。ダウンロードされるファイルの名前は、アップロードしたファイル名に形式を付加したものになります。たとえば invoice.pdf をJSONで解析した場合は、invoice.pdf.json として取得されます。

DocLang

DocLang は、IBM、NVIDIA、Red Hat、ABBYY、HumanSignal、Forgis が設立したワーキンググループによる、オープンで AI ネイティブなドキュメント標準です。ABBYY が推奨する形式であり、FineParser は単一の .doclang ファイルとして出力します。詳細は DocLang を参照してください。

JSON

JSON出力には、ドキュメントのタイトル、ページ、テキスト、テーブル、レイアウト要素が含まれ、それぞれに境界ボックスが付与されます。

プレーンテキスト

プレーンテキストでは、認識されたテキストがマークアップなしで読み順どおりに返されます。