Skip to main content
Um einen Skill zu trainieren und zu testen, benötigen Sie annotierte Dokumente — Dokumente, bei denen Feldpositionen und Datentypen explizit markiert sind. Der schnellste Weg zu einem annotierten Satz ist die manuelle Kennzeichnung von Dokumenten, doch das ist zeitaufwendig, insbesondere bei Deep-Learning-Aktivitäten, für die große Trainingsdatensätze erforderlich sind. Um Zeit zu sparen, können Sie annotierte Dokumente aus bereits erstellten Skills, aus manuell überprüften Verarbeitungsergebnissen oder aus ABBYY FlexiCapture wiederverwenden.

Dokumente manuell kennzeichnen

Markieren Sie für jedes hochgeladene Dokument die Positionen der Felder und geben Sie den Datentyp an, den jedes Feld voraussichtlich enthält. Befolgen Sie die Richtlinien für die Kennzeichnung, um verlässliche Trainingsergebnisse zu erzielen.

Annotierte Dokumente aus einer anderen Quelle wiederverwenden

Sie können annotierte Dokumente aus drei Quellen importieren. Exportieren Sie die annotierten Dokumente in jedem Fall aus der Quelle in einen Ordner, und importieren Sie diesen Ordner dann in den Dokumentensatz Alle Dokumente Ihres Skills.

Skill-Trainingsdatensatz

Wenn Sie einen Skill für den Produktiveinsatz veröffentlichen, entfernen Sie in der Regel den Trainingsdatensatz und behalten in der veröffentlichten Version nur einige Beispieldokumente bei. Wenn Sie denselben Trainingsdatensatz für eine neue Version des Skills wiederverwenden möchten, exportieren Sie ihn vor dem Veröffentlichen. Klicken Sie zum Exportieren auf das Mehr-Symbol neben dem Namen des Dokumentensatzes und wählen Sie Export Set with Labeling. Der Zielordner enthält:
  • documentdefinition.json
  • skillsettings.json
  • Einen Unterordner <Document name> für jedes Dokument mit den Dokumentbildern, documentinfo.json und labeling.json

Manuell überprüfte Verarbeitungsergebnisse

Bei der Manuellen Überprüfung entstehen als Nebeneffekt annotierte Dokumente. Richten Sie Exporte für Folgendes ein:
  • Felddaten in JSON mit aktivierter Option Werte, Metadaten und Feldstruktur für jedes Dokument.
  • Dokumentbilder in einem beliebigen unterstützten Bildformat.
Der Zielordner enthält einen Unterordner pro Vorgang. Jeder Unterordner <Transaction ID> enthält:
  • <Applied skill name>.json mit den Felddaten.
  • Exportierte Bilder: <Applied skill name>.pdf, <Applied skill name>.tiff oder einen Unterordner <Applied skill name>/Pages mit page_*.jpg-Dateien.

FlexiCapture

Sie können Dokumente wiederverwenden, die zuvor in ABBYY FlexiCapture annotiert wurden — Informationen zu Format und Vorgehensweise finden Sie unter Annotierte Dokumente aus FlexiCapture importieren.

Die annotierten Dokumente importieren

Sobald Sie einen Exportordner aus einer der oben genannten Quellen haben, importieren Sie ihn in Ihren Skill:
1

Das Set „Alle Dokumente“ öffnen

Wählen Sie auf der Registerkarte Dokumente das Set Alle Dokumente aus.
2

„Annotierte Dokumente aus Ordner importieren“ auswählen

Klicken Sie auf den Dropdown-Pfeil neben Hochladen und wählen Sie Annotierte Dokumente aus Ordner importieren….
3

Den Exportordner auswählen

Wählen Sie den Ordner aus, den Sie mit dem Exportvorgang für Ihre Quelle erstellt haben.
Ändern Sie den beim Export erstellten Ordner nicht. Das Umbenennen von Dateien oder das Ändern der Unterordnerstruktur kann dazu führen, dass der Import fehlschlägt.
Wenn bereits ein Dokument mit demselben Namen vorhanden ist, fragt Advanced Designer, wie das Duplikat behandelt werden soll:
  • Kennzeichnung aktualisieren — überschreibt Feldpositionen und Einstellungen bei Feldern mit identischem Namen und fügt alle Felder hinzu, die nur im importierten Dokument vorhanden sind.
  • Als neue Dokumente importieren — benennt die Duplikate um und importiert sie mit ihren Kennzeichnungen.