Scaling
Flux de travail
Optimisez la configuration du flux de travail ABBYY FlexiCapture pour améliorer les performances en limitant le nombre d’étapes, en traitant l’étape la plus lente et en dimensionnant correctement les tâches parallèles.
La configuration du flux de travail a un impact significatif sur les performances du système et la charge du matériel. Tous les chiffres de performance publiés reposent sur le flux de travail par défaut, qui comprend les étapes de prétraitement, de reconnaissance, de vérification et d’Export.
Pour répondre aux exigences de projets spécifiques, vous pouvez ajouter des étapes de traitement, les réorganiser et configurer des règles de routage sophistiquées. Dans ce cas, gardez ces recommandations à l’esprit.
Chaque étape télécharge les données à traiter, les traite et renvoie les résultats au serveur. Ces trois opérations consomment des ressources ; chaque étape augmente donc également le coût total du projet.
Par exemple, vous souhaiterez peut-être ajouter une étape personnalisée qui exécute un script automatique. Avant de le faire, envisagez d’exécuter ce script depuis une règle ou un événement prédéfini, ou de l’intégrer à une étape existante.
L’étape la plus lente limite les performances globales. Les étapes les plus lentes sont généralement celles qui nécessitent une intervention manuelle. Des goulets d’étranglement apparaissent également lors du traitement sans intervention. Les causes habituelles sont des scripts personnalisés inefficaces et un accès lent à des ressources externes non mises en cache.
Surveillez les files d’attente à chaque étape dans l’Administration and Monitoring Console afin d’identifier l’étape la plus lente. Accélérez-la ensuite ou, au minimum, parallélisez-la à l’aide de l’option Documents par tâche dans les propriétés de l’étape.
Lorsque vous parallélisez le traitement à une étape, évitez de le fractionner en trop d’éléments. Le traitement de chacun d’eux demande un surcroît de travail au système. En particulier, un grand nombre de très petites tâches automatiques peut ralentir le Processing Server qui les répartit entre les exécuteurs.
Supposons qu’un lot contienne généralement 10 documents et que vous souhaitiez exécuter l’étape deux fois plus vite. Deux tâches de 5 documents chacune suffisent. Par défaut, un lot est traité comme une seule tâche. Évitez de créer une tâche par document lorsque ce n’est pas nécessaire.
Une tâche plus petite qu’un lot limite également ce que l’exécuteur peut faire. Un vérificateur peut traiter les documents un à la fois. L’assemblage automatique de documents ne le peut pas, car il nécessite toutes les pages d’un lot dans une seule tâche.
