Standardszenario
1
Document Definition erstellen
Erstellen Sie eine Document Definition. Aktivieren Sie in den Abschnittseigenschaften Allow field location training.
2
Felder erstellen
Erstellen Sie die Felder im Abschnitt und aktivieren Sie in den Eigenschaften jedes Feldes Can have region.
3
Speichern und veröffentlichen
Speichern und veröffentlichen Sie die Document Definition.
4
Trainings-Batch erstellen
Wechseln Sie in den Modus Field Extraction Training Batches und erstellen Sie einen neuen Batch. Wählen Sie die erstellte Document Definition und anschließend Default variant aus der Variantenliste aus.
5
Dokumentbilder laden und erkennen
Laden Sie Dokumentbilder und führen Sie die Erkennung durch. Laden Sie für jede Dokumentart 3 bis 50 Bilder.
6
Feldpositionen anpassen
Passen Sie die Positionen der Felder an.
7
Dokumentstatus festlegen
Wählen Sie einige Dokumente aus, klicken Sie mit der rechten Maustaste darauf und wählen Sie Set Document State → For training. Wählen Sie die übrigen Dokumente aus und wählen Sie Set Document State → For testing. Verwenden Sie etwa 60 % des Batches für das Training und 40 % für das Testen.
8
Feldextraktion trainieren
- (Standalone) Klicken Sie auf Fields Training → Train.
- (Distributed) Klicken Sie auf Fields Training → Train, um auf dem Computer zu trainieren, auf dem die Project Setup Station installiert ist.
- (Distributed) Um auf einer Processing Station zu trainieren, klicken Sie mit der rechten Maustaste auf den Batch und wählen Sie Send for Training.
Projekte mit mehreren Dokumentvarianten
1
Document Definition erstellen
Erstellen Sie eine Document Definition. Aktivieren Sie in den Abschnittseigenschaften Allow field location training und erstellen Sie die Felder mit aktivierter Option Can have region.
2
Abschnittsvarianten hinzufügen
Fügen Sie Abschnittsvarianten mithilfe einer der folgenden Methoden hinzu:
- Varianten manuell erstellen: Klicken Sie auf der Registerkarte Data Sets der Abschnittseigenschaften auf View und dann auf Add.
- Varianten aus einer Datenbank laden: Klicken Sie auf der Registerkarte Data Sets auf Set Up und wählen Sie Database als Datenquelle aus.
- Varianten mithilfe eines Skripts erstellen: Klicken Sie auf der Registerkarte Data Sets auf Set Up und wählen Sie Script als Datenquelle aus.
3
Speichern und veröffentlichen
Speichern und veröffentlichen Sie die Document Definition.
4
Klassifikator für die Varianten trainieren
- Wechseln Sie in den Modus Open Classifier Training Batches und laden Sie Dokumentbilder in einen neuen Batch.
- Weisen Sie jedem Dokument eine Referenzklasse zu, wobei Sie Varianten als separate Klassen verwenden. Klicken Sie auf Set Class → Add → Add, wählen Sie Specify variant und anschließend eine Variante aus der Liste aus.
- Trainieren Sie den Klassifikator über Classification Training → Train.
5
Feldregionserkennung für jede Variante trainieren
- Wechseln Sie in den Modus Field Extraction Training Batches und erstellen Sie einen neuen Batch.
- Wählen Sie Ihre Document Definition und eine zu trainierende Variante aus.
- Laden Sie 3 bis 50 Bilder pro Dokumenttyp, erkennen Sie sie, passen Sie die Feldpositionen an und legen Sie den Dokumentstatus fest (For training / For testing).
- Trainieren Sie die Felder:
- (Standalone) Klicken Sie auf Fields Training → Train.
- (Distributed) Klicken Sie auf Fields Training → Train, um auf dem Computer zu trainieren, auf dem die Project Setup Station installiert ist.
- (Distributed) Um auf einer Processing Station zu trainieren, klicken Sie mit der rechten Maustaste auf den Batch und wählen Sie Send for Training aus.
(Distributed) Trainings-Batches an eine Processing Station senden
- (Distributed) Dem Processing Server mindestens eine Processing Station hinzugefügt wurde.
- (Distributed) Das Projekt auf den Server hochgeladen wurde.
