Zusätzliches Training ist für in Dokumentdefinitionen geladene NLP-Modelle nicht verfügbar.
Training während der Verifizierung starten
- Fügen Sie eine Trainingsstufe nach der Verifizierungsstufe hinzu. Das Training startet, wenn die für den Trainings-Batch festgelegten Bedingungen erfüllt sind. Weitere Informationen finden Sie unter Workflow-Einrichtung.
- Senden Sie Dokumente manuell an die Trainingsstufe: Klicken Sie im Arbeits-Batch mit der rechten Maustaste auf das Dokument und wählen Sie Train aus.
So funktioniert das Training
- Beim Start des Trainings erstellt FlexiCapture einen allgemeinen Trainings-Batch (falls noch keiner vorhanden ist) und kopiert unabhängig von der Variante jedes Dokument der Dokumentdefinition hinein.
- Jedem Dokument wird der Status For training oder For testing zugewiesen.
- Dokumente mit dem Status For training werden zum Erstellen eines neuen NLP-Modells verwendet.
- Das neue Modell wird anhand der Dokumente mit dem Status For testing getestet.
- Wenn das neue Modell nicht schlechter abschneidet als das vorhandene, ersetzt es dieses. Andernfalls wird es abgelehnt.
Einen Trainings-Batch für einen bestimmten Vendor oder eine bestimmte Variante erstellen
1
Projekt öffnen
Öffnen Sie auf der Project Setup Station das Projekt mit dem NLP-Modell. Weitere Informationen finden Sie unter NLP-Modelle erstellen.
2
Batches für Feldextraktionstraining öffnen
Wählen Sie Fields Training → Open Field Extraction Training Batches, drücken Sie Strg+Alt+B oder wählen Sie im Kontextmenü Field Extraction Training Batches.
3
Batch erstellen
Wählen Sie File → New Batch (oder drücken Sie Strg+N). Wählen Sie die Dokumentdefinition und die Variante aus und anschließend im Kontextmenü NLP Batch.
4
Dokumente hinzufügen und trainieren
Fügen Sie Ihre Dokumente hinzu, erkennen Sie sie, ändern Sie die Reihenfolge der Abschnitte und starten Sie das Training über Train im Kontextmenü, Strg+F7 oder die Schaltfläche Train Batch in der Symbolleiste.
- Markieren Sie jedes in der Dokumentdefinition beschriebene Feld in den Trainingsdokumenten.
- Nehmen Sie 100 bis 500 Dokumente in jeden Trainings-Batch auf. In diesem Bereich kann FlexiCapture die besten Parameter auswählen, ohne das Training zu verlangsamen.
- Für eine Variante mit eigenem Trainings-Batch wird das für diesen Batch erstellte Modell verwendet.
- Für alle anderen Varianten wird das für den allgemeinen Trainings-Batch erstellte Modell verwendet.
Trainings-Batch-Einstellungen
Trainingsstatistiken exportieren
- Die Trainings-Batch-Einstellungen.
- Informationen zu den neuen und alten NLP-Modellen.
- Die Trainingszeit.
- Die Version der verwendeten NLP-Komponente.
- Statistiken zum Dokument- und Feldtraining.
- Die Aktualität der exportierten Daten. Wenn der Parameter
isActualauffalsegesetzt ist, wurde der Batch nach dem Training geändert, beispielsweise durch das Hinzufügen oder Entfernen von Dokumenten oder durch Änderungen am Markup. Starten Sie das Training erneut, um aktuelle Statistiken zu erhalten.
