Published On: 28. September 2026Von

FineParser strukturiert Dokumente im Docker-Container

ABBYY bietet mit FineParser einen CPU-basierten Dokumentenparser als Docker-Container an. Die Lösung analysiert Dokumente und stellt die Ergebnisse unter anderem als Klartext, JSON oder im neuen DocLang-Format bereit.

Bereitstellungsmodie von ABBYY FineParser (Bild: ABBYY)

09-25-26-Abbyy-Fineparser

Bereitstellungsmodi von ABBYY FineParser (Bild: ABBYY)

 FineParser basiert auf FineReader Engine von Abbyy

Mit »FineParser« stellt ABBYY eine einsatzreife Lösung zur automatisierten Dokumentenanalyse vor. Sie richtet sich an Entwickler, die Pipelines für Retrieval-Augmented Generation (RAG), KI-Agenten und Anwendungen auf Basis großer Sprachmodelle (LLMs) erstellen. Basierend auf der OCR-Technologie (Optical Character Recognition) von Abbyy wandelt FineParser komplexe Geschäftsdokumente in strukturierte, KI-taugliche Formate (darunter DocLang, JSON, ALTO und XML) um. FineParser lässt sich über seine REST-API in bestehende Arbeitsabläufe integrieren. Dokumente können an den Dienst übermittelt werden; die resultierende strukturierte Ausgabe kann als Klartext, JSON oder im ABBYY-eigenen DocLang-Format erfolgen.

Speziell basiert FineParser auf der Technologie der »ABBYY FineReader Engine« und soll als Einstieg in das Document-AI-Portfolio von Abbyy dienen. Unternehmen, die FineParser für die Dokumentenanalyse und -erfassung nutzen, können bei wachsenden Anforderungen an die Dokumentenautomatisierung auf die FineReader Engine (für einen größeren Funktionsumfang) und schließlich auf »ABBYY Vantage« (für umfassende intelligente Dokumentenverarbeitung inklusive Klassifizierung, Validierung und Extraktion) umsteigen.

CPU-basierter Docker-Container ohne GPU

FineParser wird als reiner CPU-basierter Docker-Container bereitgestellt. Dies ermöglicht es Unternehmen, Dokumente lokal oder in ihrer bevorzugten Cloud-Umgebung zu verarbeiten, ohne GPUs oder externe Datenübertragungen zu benötigen. Die Lösung liefert strukturierte Ergebnisse in KI-nativen Formaten wie DocLang, JSON und XML, wobei wichtige Elemente wie Tabellen, Leserichtung, Überschriften und die Dokumentenhierarchie erhalten bleiben.

Spezifische Anforderungen – wie unterstützte CPU-Architekturen, Mindestanforderungen an CPU und RAM, Speicherplatz, Docker-Versionen und unterstützte Host-Betriebssysteme – hängen von der jeweiligen Bereitstellungsumgebung ab. Detaillierte Systemanforderungen sind in der technischen Dokumentation von Abbyy enthalten.

Schnelle Einsatzbereitschaft

Laut Angaben von Abbyy ist FineParser in wenigen Minuten einsatzbereit. Die Aussage bezieht sich auf die Zeitspanne von der ersten Bereitstellung von FineParser bis zur eigentlichen Verarbeitung (dem Parsing) eines Dokuments.

Der grundlegende Arbeitsablauf umfasst das Starten des Docker-Containers mit der entsprechenden Lizenz, das Übermitteln eines Dokuments über die REST-API sowie den Erhalt der strukturierten Ausgabe. Es geht bei dieser Aussage also um die Inbetriebnahme von FineParser und die Verarbeitung von Dokumenten, nicht um die Einrichtung einer vollständigen Produktionsumgebung auf Unternehmensebene. Je nach Infrastruktur des jeweiligen Unternehmens können zusätzliche Konfigurationsschritte für Netzwerk, Sicherheit, Orchestrierung, Überwachung und die Integration in nachgelagerte Systeme erforderlich sein.

FineParser unterscheidet 208 Sprachen

Da FineParser auf der FineReader Engine basiert, unterstützt der Parser 208 Sprachen und Schriften – darunter Chinesisch, Japanisch, Koreanisch, Arabisch, Hebräisch, indische Sprachen, Thailändisch sowie lateinische und kyrillische Zeichensätze. Aufgrund fortschrittlicher Vorverarbeitungsfunktionen wird die Bildqualität vor der Erkennung automatisch optimiert. Dies maximiert die Genauigkeit bei gescannten Dokumenten, fotografierten Inhalten, handschriftlichen Texten, Formularen und Barcodes.

Bedeutung der DocLang-Unterstützung

Als wesentliches Alleinstellungsmerkmal von FineParser bezeichnet Abbyy die Unterstützung von DocLang. Dabei handelt es sich um einen offenen Standard für eine KI-taugliche Dokumentendarstellung, der in Zusammenarbeit von ABBYY, IBM, NVIDIA, Red Hat und der Linux Foundation entwickelt wurde. DocLang soll zur Senkung der Dokumentenverarbeitungskosten beitragen, indem Daten bereits bei der Erfassung strukturiert und verständlich aufbereitet werden. Damit entfalle laut Abbyy eine aufwendige Rekonstruktion jedes Dokuments durch ein LLM im weiteren Workflow. Um diesen Effekt auszunutzen, müssen die weiteren Lösungen im Workflow DocLang ebenfalls unterstützen. Da es sich bei DocLang um einen relativ neu entwickelten Standard handelt, ist die Unterstützung noch nicht auf breiter Front gegeben. Auch FineParser gehört zu den ersten kommerziellen Parsing-Lösungen, die eine native DocLang-Ausgabe bieten.

Preisgestaltung des Parsers

FineParser ist ab sofort verfügbar. Bis zu 1.000 Seiten pro Monat und für die Dauer von einem Jahr ist eine kostenlose Version erhältlich.

Die kostenpflichtigen Abonnement-Pakete sind derzeit wie folgt strukturiert:

  • Starter: 119 US Dollar pro Monat für bis zu 25.000 Seiten
  • Growth: 750 US Dollar pro Monat für bis zu 250.000 Seiten
  • Business: 2.000 US Dollar pro Monat für bis zu 1 Million Seiten
  • Enterprise: Individuelle Preisgestaltung, einschließlich unbegrenztem Volumen

Die Verarbeitung der Dokumentendaten erfolgt vollständig in der Umgebung des Kunden; eine Übermittlung an Abbyy oder Drittanbieter findet nicht statt. Für Unternehmen mit stark regulierten Umgebungen oder isolierten Systemen  stehen dieselben Funktionen auch über die ABBYY FineReader Engine zur Verfügung.

FineParser ist für ein breites Spektrum an Anwendungsfällen konzipiert, darunter die Verarbeitung im Finanzwesen, die Verwaltung von Gesundheitsakten, die Analyse juristischer Dokumente sowie mehrsprachige Geschäftsprozesse.

Weitere Artikel

About the Author: Annette Stadler

Annette Stadler ist IT-Journalistin und leitet das Online-Portal ECMGUIDE.
Nach oben