Skip to main content
FineParser está construido sobre ABBYY FineReader Engine, el SDK de OCR y análisis de documentos que ABBYY lleva más de dos décadas suministrando a fabricantes de software e integradores. Ese mismo engine reconoce el texto, detecta las tablas y determina el orden de lectura en cada documento que usted envía a /parse. Lo que aporta FineParser es el empaquetado: un contenedor Docker, un endpoint REST, un conjunto fijo de ajustes del engine probados a fondo y formatos de salida pensados para flujos con LLM. Esta página está dirigida a quienes quieran saber qué hay por debajo y en qué casos conviene bajar un nivel y trabajar directamente con el engine.

Relación entre ambos productos

FineParser toma por usted un número reducido de decisiones, de modo que nunca tenga que abrir un SDK. Expone dos modos de reconocimiento, tres formatos de salida y un ajuste de idioma, y mantiene todo lo demás constante. Esos valores predeterminados provienen de las configuraciones que el propio engine recomienda para la extracción de datos estructurados y para la extracción rápida de texto, de modo que los resultados que obtiene con FineParser son los que produce FineReader Engine cuando se configura tal como ABBYY lo recomienda para esas tareas. FineReader Engine, por su parte, es una biblioteca que usted enlaza con su propia aplicación. Funciona en Windows, Linux y macOS, y se invoca desde C++, C#, .NET, Java y lenguajes de scripting compatibles con COM. Al tratarse de una biblioteca y no de un servicio, nada del flujo de procesamiento es fijo. Cada etapa, desde el preprocesamiento de imágenes hasta el análisis de diseño, el reconocimiento y la exportación, se expone como objetos y propiedades que su código puede leer y modificar.

Cuándo basta con FineParser

La mayoría de los equipos que crean flujos RAG, herramientas de agentes o servicios de ingesta de documentos no necesitan nada más que FineParser. Si su objetivo es convertir archivos PDF e imágenes en DocLang, JSON o texto sin formato con una buena recuperación de la estructura, y desea hacerlo mediante un contenedor y una llamada HTTP en lugar de una dependencia compilada, FineParser es la herramienta adecuada y puede dejar de leer aquí.

Cuándo considerar FineReader Engine

FineReader Engine es la opción adecuada cuando la naturaleza del problema ya no encaja en un único endpoint con unos pocos parámetros. Normalmente, eso ocurre en alguno de los siguientes casos.
  • Va a incorporar el reconocimiento en su propio producto. FineReader Engine se licencia para su integración en software comercial y se ejecuta in-process, por lo que no hay ningún contenedor que desplegar junto a su aplicación ni una llamada HTTP por cada documento.
  • Necesita formatos de salida que FineParser no genera. El engine exporta a PDF con capacidad de búsqueda y PDF/A, DOCX, XLSX, PPTX, HTML, ALTO, ABBYY XML, EPUB y más, además de DocLang, JSON y texto sin formato. Consulte Export Formats.
  • Necesita funciones de reconocimiento que quedan fuera del alcance de FineParser. Entre ellas están el reconocimiento de códigos de barras 1D y 2D, la captura de la machine-readable zone en pasaportes y tarjetas de identidad, el reconocimiento de campos manuscritos (ICR) en formularios, el reconocimiento de marcas de verificación (OMR), el análisis de tarjetas de visita, la document classification y la Document Comparison. Los escenarios de uso básicos de la documentación del engine explican cada uno de ellos paso a paso.
  • Necesita adaptar el flujo a sus documentos. Los modos de FineParser son fijos. Con el engine puede partir de un perfil predefinido y ajustar después parámetros concretos de preprocesamiento, analysis, reconocimiento y synthesis, algo decisivo cuando trabaja con layouts poco habituales, escaneos deteriorados o un tipo de documento muy específico en el que los valores predeterminados desaprovechan accuracy.
  • Necesita control sobre el modelo de procesamiento. El engine le ofrece primitivas de parallel processing, iteración página a página, reconocimiento a nivel de region y la posibilidad de inspeccionar y editar el layout reconocido antes de exportarlo. FineParser procesa el documento completo y devuelve el resultado.
Si lo que busca es la simplicidad de FineParser con un ajuste al nivel del engine, valore FineParser Enterprise antes de optar por una integración con el SDK. Enterprise mantiene el contenedor y la REST API, pero abre la configuración de procesamiento del engine, de modo que puede ajustar el reconocimiento a sus documentos sin programar contra la API del engine.

Licensing

FineReader Engine se licencia por separado de FineParser. Un plan de FineParser no incluye una licencia Developer ni Runtime de FineReader Engine, y ambas no son intercambiables. El engine se comercializa a través del equipo de ventas y los Partners de ABBYY, con opciones de licenciamiento que incluyen modelos por página, por núcleo y en línea. Consulte Licensing en la documentación del engine para saber cómo funcionan, o póngase en contacto con ABBYY para analizar su caso de uso.

Más información

Presentación de FineReader Engine 12

Qué hace el engine, sus principales funciones y cómo se organiza la documentación.

Escenarios de uso básicos

Implementaciones paso a paso de extracción de datos, extracción de texto, conversión, archivado y mucho más.

Trabajo con perfiles

Perfiles predefinidos y cómo crear su propia configuración.

Referencia de la API

Todos los objetos, interfaces, métodos y enumeraciones del engine.