Saltar al contenido principal
Los FlexiLayouts y los clasificadores cuentan con varias configuraciones definidas por el usuario, incluidas opciones de prerreconocimiento como los idiomas de reconocimiento, el tipo de texto, los modos de prerreconocimiento y las áreas. Seleccionar la configuración de prerreconocimiento adecuada le ayudará a crear FlexiLayouts y clasificadores bien adaptados al procesamiento de sus documentos. Puede cambiar la configuración de prerreconocimiento en el cuadro de diálogo Propiedades de prerreconocimiento. Para abrir este cuadro de diálogo, use una de las siguientes formas:
  • Haga clic en Properties… en el menú FlexiLayout o Classifier, o en el menú contextual del FlexiLayout o clasificador.
  • Haga clic en el botón Advanced Pre-recognition Properties… en la pestaña General del cuadro de diálogo de propiedades del FlexiLayout o clasificador.
Las siguientes opciones están disponibles en el cuadro de diálogo Propiedades de prerreconocimiento.

Pestaña General

Nombre – El método utilizado para imprimir el texto en los documentos:
  • Tipográfico
  • Impresora matricial
  • Máquina de escribir
Determine el tipo de texto y evalúe su calidad antes de seleccionar estas opciones. Modo de prerreconocimiento – El modo de prerreconocimiento:
  • Modo Rápido. Las imágenes en color y de semitonos se binarizan antes del reconocimiento (se convierten a blanco y negro). El reconocimiento rápido requiere menos tiempo y, por lo general, ofrece resultados satisfactorios.
  • Modo Equilibrado. También se tienen en cuenta los colores de la imagen. El reconocimiento es más lento, pero la calidad es mejor.
    No se prevén más modificaciones en los algoritmos del modo de reconocimiento Equilibrado, ya que se ha alcanzado la mejor combinación posible de velocidad y calidad.
  • El modo Normal es el predeterminado. También se recomienda cuando el prerreconocimiento en el modo Rápido / Equilibrado produce varios errores.
  • El modo Preciso está pensado para extraer datos de imágenes digitales apenas legibles o de documentos de baja calidad.
    El modo Preciso es el que más tiempo requiere y, por lo tanto, se recomienda usarlo solo con imágenes/documentos problemáticos.

Pestaña Idiomas

Idiomas de texto – Los idiomas utilizados en los documentos. Puede seleccionar uno o varios idiomas en la lista desplegable. Para consultar la lista completa de idiomas disponibles, consulte Idiomas de OCR compatibles con ABBYY FlexiLayout™ Studio. User dictionaries – Este grupo de opciones le permite agregar User dictionaries. Los User Dictionaries se utilizan para mejorar la calidad del reconocimiento al complementar los diccionarios predefinidos con vocabulario especializado, abreviaturas, nombres de empresas, etc.

Pestaña Advanced

Códigos de barras – Este grupo contiene las siguientes opciones de procesamiento de códigos de barras:
  • Deshabilitar la extracción de códigos de barras – Seleccione esta opción si no desea que se detecten códigos de barras en sus imágenes. Esto acelerará considerablemente el reconocimiento de documentos.
  • Extraer códigos de barras 2D: Data Matrix, Aztec, QR Code – Seleccione esta opción si las imágenes que necesita procesar contienen códigos de barras Data Matrix, Aztec y QR Code. Si esta opción no está habilitada, estos códigos de barras no se detectarán en las imágenes y no estarán disponibles en las propiedades del elemento código de barras.
  • Extraer códigos de barras postales – Seleccione esta opción si sus imágenes contienen códigos de barras postales, por ejemplo, Australia Post. Si esta opción no está seleccionada, los códigos de barras postales no se detectarán en las imágenes y no estarán disponibles en las propiedades del elemento código de barras.
    La extracción de códigos de barras postales ralentiza el reconocimiento.
CJK – Contiene opciones para procesar idiomas CJK (chino, japonés y coreano):
  • Modo furigana separado – Seleccione esta opción para mejorar la calidad del reconocimiento al procesar texto japonés con furigana (ayudas de pronunciación).
Reconocimiento de NER:
  • Extraer Named Entities (NER) – Seleccione esta opción para extraer información relevante de un campo o grupo de campos mediante métodos de NLP.
    Esta opción solo está disponible para las licencias que incluyen un módulo de NLP.
Extracción de texto vertical – Parámetros de extracción de texto vertical:
  • Extraer para todos los idiomas – Detecta texto orientado verticalmente escrito en cualquiera de los idiomas compatibles.
  • No extraer – Impide la detección de texto orientado verticalmente.
  • Extraer para idiomas CJK – Detecta texto vertical escrito en chino, japonés o coreano.
Área de prerreconocimiento – El área que se va a prerreconocer. Puede especificar la posición del área de prerreconocimiento en relación con los bordes de la página. Patrón de usuario – Esta opción le permite agregar un patrón de usuario en formato PTN o FBT. Recomendamos usar estos patrones de usuario si sus documentos contienen fuentes y caracteres no estándar.