Skip to main content
FineParser renvoie chaque document analysé dans l’un des trois formats suivants. Ceux-ci se distinguent par la part de la structure du document qu’ils préservent et par la façon dont celle-ci est encodée.

Définition du format de sortie

Transmettez le champ outputType à chaque requête. Il n’existe pas de valeur par défaut : chaque requête doit donc indiquer un format. Contrairement au mode de reconnaissance et aux langues, le format se choisit requête par requête, si bien qu’un seul container peut prendre en charge les trois.
La soumission renvoie un ID de job. Interrogez le job et téléchargez le résultat comme décrit dans REST API. Le fichier téléchargé porte le nom du fichier téléversé suivi du format : invoice.pdf analysé en JSON est donc livré sous le nom invoice.pdf.json.

DocLang

DocLang est un standard documentaire ouvert et nativement conçu pour l’IA, issu d’un groupe de travail fondé par IBM, NVIDIA, Red Hat, ABBYY, HumanSignal et Forgis. C’est le format que nous recommandons, et FineParser l’écrit dans un fichier .doclang unique. Voir DocLang.

JSON

La sortie JSON contient le titre du document, les pages, le texte, les tableaux et les éléments de mise en page, chacun avec ses zones englobantes.

Texte brut

Le texte brut renvoie le texte reconnu dans l’ordre de lecture, sans aucun balisage.