Skip to main content
FineParser ist ein selbstgehosteter Dokumentenparser für KI-Pipelines. Er läuft als einzelner Docker-Container auf CPU-Hardware und stellt eine schlanke REST API bereit: Dokument übermitteln, anschließend dessen Struktur und Text als DocLang, JSON oder Klartext herunterladen. Kein Cloud-Konto, keine GPU – und keine Dokumentdaten verlassen Ihre Infrastruktur. Grundlage ist der Erkennungskern der ABBYY FineReader Engine, aufbereitet für Entwickler, die produktionsreifes Parsing ohne SDK-Integration nutzen möchten.

Schnellstart

Starten Sie den Container und parsen Sie Ihr erstes Dokument in weniger als fünf Minuten.

Konfiguration

Erkennungsmodus, Sprache und Ports.

REST API

Dokument übermitteln, job abfragen, Ergebnis herunterladen.

Ausgabeformate

DocLang, JSON und Klartext.

Funktionsweise

FineParser erfasst nicht nur den Text eines Dokuments, sondern rekonstruiert dessen Struktur: Tabellen (auch rahmenlose), mehrspaltige Layouts, Überschriften, Lesereihenfolge und Hierarchie. Handschrift, Kontrollkästchen und Bilder werden zusammen mit dem Text erkannt. Die Ausgabe lässt sich direkt für RAG-Ingestion, Agenten-Workflows oder LLM-Prompts verwenden.

Warum Teams es einsetzen

  • Erhält Tabellen, Spalten und Überschriften und gibt an, wo sich jedes Element auf der Seite befindet.
  • Gibt DocLang aus, ein kompaktes Format für die LLM-Eingabe, das wir empfehlen. JSON und Klartext stehen ebenfalls zur Verfügung.
  • Läuft als einzelner Container auf CPU-Hardware, auf Ihren eigenen Rechnern oder in Ihrer eigenen Cloud.
  • Zwei Erkennungsmodi: schneller Modus für große Mengen, Modus mit hoher Wiedergabetreue, wenn es vor allem auf Genauigkeit ankommt.
  • Erkennt mehr als 200 Sprachen, darunter lateinische, kyrillische, CJK- und arabische Schriften.
  • Beginnen Sie mit dem kostenlosen Tarif, wechseln Sie mit wachsendem Volumen zu einem kostenpflichtigen Tarif oder steigen Sie auf Enterprise um, wenn Sie hohen Durchsatz und eine Offline-Bereitstellung benötigen.