Skip to main content

Crear campos de documento

Para cada entidad que desee extraer, cree un campo correspondiente en la Definición de Document.
1

Agregar un campo

En el Editor de Definición de Document, haga clic con el botón derecho en el nombre de la sección del documento y seleccione Create Field.
2

Convertirlo en un campo Text

Cree un campo Text.
3

Habilitar una región

En la pestaña General, seleccione Can have region.
4

Asignar un nombre al campo

En el campo Name, escriba un nombre (por ejemplo, PreambleSegment). Los nombres de los campos no deben contener espacios ni caracteres no ingleses, ni comenzar con un número.
Captura de pantalla de la pestaña General del cuadro de diálogo de propiedades del campo en el Editor de Definición de Document de ABBYY FlexiCapture, con el campo denominado PreambleSegment y las opciones Can have region y Text segment seleccionadas.
Repita estos pasos para cada entidad. Si se usa la segmentación, cree un campo de texto independiente para cada segmento: cree un campo no repetible en un grupo repetido, seleccione Text segment en las propiedades del campo y seleccione Allow multiple regions si un segmento puede comenzar y terminar en páginas diferentes.

Crear un modelo de segmentación

La segmentación mejora la precisión y la velocidad de la extracción de entidades, y es opcional. Requiere un modelo NLP específico y solo puede haber un modelo de segmentación por sección del documento.
1

Abra las propiedades de la sección

En el Editor de Definición de Document, haga clic con el botón derecho en el nombre de la sección del documento y seleccione Properties. En la pestaña NLP, haga clic en Create.
2

Asigne un nombre al modelo y establezca su tipo

En el campo Name, introduzca un nombre (por ejemplo, SegmentationModel). Establezca Model type en Segmentation y seleccione el Language requerido.
Captura de pantalla del cuadro de diálogo New NLP Model en la pestaña NLP de las propiedades de la sección del documento en ABBYY FlexiCapture, con el modelo denominado SegmentationModel, Source establecido en Section, Model type establecido en Segmentation y Language establecido en English.
3

Elija los campos de segmento

Haga clic en Next, especifique los campos en los que se extraerán los segmentos y haga clic en OK.
Después de crear un modelo de segmentación, entrene el modelo con documentos de ejemplo.

Crear un modelo de extracción de entidades

Para extraer entidades, necesita un modelo NLP de extracción de entidades entrenado con documentos etiquetados manualmente.
1

Abrir las propiedades de la sección

En el Editor de Definición de Document, abra las propiedades de la sección del documento, haga clic en la pestaña NLP y, a continuación, en Create.
2

Asignar un nombre al modelo y establecer su tipo

Introduzca un Name (por ejemplo, EntitiesExtraction). Como fuente de datos, seleccione una sección (si no utiliza la segmentación) o un segmento (si la utiliza). Establezca Model type en Extraction y seleccione el Language necesario.
3

Elegir los campos de resultado

Haga clic en Next y elija los campos de resultado que se extraerán de la sección o el segmento seleccionado.
Repita estos pasos para cada segmento o sección del documento del que deban extraerse entidades. A continuación, guarde la Definición de Document (Document Definition → Save), ciérrela (Document Definition → Close) y publíquela (Document Definition → Publish). Después de crear un modelo de extracción de entidades, entrénelo con documentos de ejemplo.
La opción Allow training permite entrenar un modelo NLP durante el procesamiento de documentos: el modelo se entrena al realizar el entrenamiento de extracción de campos mediante un lote de entrenamiento de extracción de campos. Para deshabilitar o eliminar los resultados del entrenamiento, haga clic con el botón derecho en el lote de entrenamiento y seleccione Disabled o Delete en el menú contextual.