Zum Hauptinhalt springen
FromNine
Menü

Intelligente Dokumentenverarbeitung

Dokumente rein, geprüfte Daten raus. Über Ausnahmen entscheiden Menschen.

Anträge, Rechnungen, Schadenmeldungen und Briefe kommen in jedem Format an. Wir entwickeln Eingangsprozesse, die jedes Dokument klassifizieren, die relevanten Felder extrahieren, sie gegen Ihre Regeln prüfen und nur die unsicheren Fälle an eine Person geben.

Für Behörden und Unternehmen in Deutschland, deren Posteingang aus Papier, PDF, E-Mail und E-Rechnung besteht und deren erfasste Werte nachvollziehbar sein müssen.

Typische Nutzergruppen
  • Sachbearbeitung
  • Backoffice-Teams
  • Finanzbuchhaltung
  • Schriftgutverwaltung
Beispielhafter Ablauf
  1. 01Aus allen Kanälen erfassenSystem
  2. 02Trennen und klassifizierenSystem
  3. 03Felder extrahierenSystem
  4. 04Gegen Regeln prüfenSystem
  5. 05PrüfwarteschlangePerson
  6. 06An das Fachsystem übergebenSystem
  7. 07Aus Korrekturen lernenSystem
Dokumente werden aus allen Kanälen erfasst und vom System klassifiziert, extrahiert und validiert. Fälle unterhalb der Konfidenzschwelle oder mit verletzter Regel gehen in einer Prüfwarteschlange an eine Person. Validierte Daten werden an das Fachsystem übergeben, und Korrekturen aus der Prüfung fließen in das Evaluierungsset ein.

Vorher und nachher

Was sich im Arbeitsalltag ändert

  1. Heute

    Heute: Abtippen aus Anhängen

    Mitarbeitende öffnen jedes PDF, jeden Scan und jedes E-Formular und übertragen Namen, Beträge und Referenzen von Hand in das Fachverfahren oder das ERP.

    Mit dem System

    Mit dem System: Daten kommen strukturiert an

    Felder werden mit ihrer Position im Quelldokument extrahiert, sodass die prüfende Person Wert und Beleg nebeneinander sieht.

  2. Heute

    Heute: Fehler fallen spät auf

    Fehlende Seiten und widersprüchliche Daten zeigen sich erst Wochen später, wenn eine Entscheidung angefochten wird oder eine Zahlung zurückkommt.

    Mit dem System

    Mit dem System: Regeln greifen schon beim Eingang

    Vollständigkeit, Abgleich mit Stammdaten und Geschäftsregeln werden geprüft, bevor ein Vorgang angelegt wird, solange beim Absender noch nachgefragt werden kann.

  3. Heute

    Heute: Jedes Dokument bekommt dieselbe Aufmerksamkeit

    Eine saubere, vollständige Rechnung dauert so lange wie eine unübersichtliche, mehrdeutige.

    Mit dem System

    Mit dem System: Aufmerksamkeit für die Ausnahmen

    Saubere Dokumente laufen direkt durch. Menschen bearbeiten eine Warteschlange mit den unsicheren und ungewöhnlichen Fällen, jeweils mit dem Grund, warum sie dort liegen.

  4. Heute

    Heute: Kein Nachweis, wie Daten erfasst wurden

    Fragt die Revision, woher ein Wert stammt, hängt die Antwort davon ab, wer ihn eingegeben hat.

    Mit dem System

    Mit dem System: Jeder Wert ist nachvollziehbar

    Quelldokument, Extraktion, Konfidenz, Regelergebnisse und Änderungen durch die Prüfung werden für jedes Feld protokolliert.

Workflow

So läuft der Prozess

Sieben Schritte, ein Ausnahmepfad. Schwellenwerte und Regeln werden mit Ihren Prozessverantwortlichen abgestimmt und an Ihren eigenen Dokumenten justiert, bevor etwas produktiv läuft.

Beispielhafter Ablauf

7 Schritte · 1 menschliche Prüfung

UNTER SCHWELLENWERT ODER REGELVERLETZT01SYSTEMAus allen Kanälen erfassen02SYSTEMTrennen und klassifizieren03SYSTEMFelder extrahieren04SYSTEMGegen Regeln prüfen05PERSONPrüfwarteschlangeMENSCHLICHE PRÜFUNG06SYSTEMAn das Fachsystem übergeben07SYSTEMAus Korrekturen lernen

Legende

  • System
  • Person
  • Menschliche Prüfung
  • Ausnahmepfad

Intelligente Dokumentenverarbeitung: beispielhafter Ablauf mit Ausnahmepfad

Diagramm als Text lesen

Der Hauptpfad führt von der Erfassung über Klassifizierung, Extraktion und Validierung zur Übergabe an das Fachsystem und endet mit dem Lernen aus Korrekturen.

Nach der Validierung verlässt jedes Dokument mit einem Feld unterhalb der Konfidenzschwelle oder einer verletzten Geschäftsregel den Hauptpfad und geht in die Prüfwarteschlange, wo eine Person die Werte bestätigt oder korrigiert. Geprüfte Dokumente kehren beim Übergabeschritt auf den Hauptpfad zurück.

Die Prüfwarteschlange ist der menschliche Kontrollpunkt: Unsichere Werte erreichen das Fachsystem nie ohne eine Person.

  1. Schritt 1: Aus allen Kanälen erfassenSystem

    Scans, E-Mail-Anhänge, Portal-Uploads und E-Formulare landen in einer gemeinsamen Eingangswarteschlange, mit Vorgangsreferenz, Kanal-Metadaten und Prüfsumme. Strukturierte E-Rechnungen (Peppol UBL) überspringen die Extraktion und gehen direkt in die Validierung.

  2. Schritt 2: Trennen und klassifizierenSystem

    Sammelsendungen aus mehreren Dokumenten werden in ihre Bestandteile getrennt. Jeder Teil wird nach Dokumenttyp und Sprache klassifiziert, was das Extraktionsschema und das passende Regelwerk bestimmt.

  3. Schritt 3: Felder extrahierenSystem

    Layoutbewusste Texterkennung (OCR) liest die Seite; ein Sprachmodell extrahiert die vereinbarten Felder in ein striktes Schema. Jedes Feld trägt einen Konfidenzwert und seine Position in der Quelle.

  4. Schritt 4: Gegen Regeln prüfenSystem

    Werte werden gegen Stammdaten (Kunden-, Lieferanten-, USt- und IBAN-Verzeichnisse), feldübergreifende Regeln und Dubletten geprüft. Felder oberhalb der vereinbarten Konfidenzschwelle, die jede Regel bestehen, laufen direkt durch.

  5. Schritt 5: PrüfwarteschlangePerson

    Die prüfende Person sieht Dokument und extrahierte Werte nebeneinander, die verletzte Regel oder das Feld mit geringer Konfidenz ist hervorgehoben, und bestätigt oder korrigiert die Werte.

    Ausnahmepfad: Unter Schwellenwert oder Regel verletzt· Zurück zu Schritt 6

    Menschliche Prüfung

    Unsichere Werte erreichen das Fachsystem nie ohne eine Person. Prüfende können ein Dokument auch zurückweisen und beim Absender ein neues anfordern.

  6. Schritt 6: An das Fachsystem übergebenSystem

    Validierte Daten legen den Vorgang im Fallmanagement, im CRM oder im ERP über dessen API an oder aktualisieren ihn, mit angehängtem Quelldokument und gesetzter Aufbewahrungsklasse.

  7. Schritt 7: Aus Korrekturen lernenSystem

    Korrekturen aus der Prüfung werden als gelabelte Beispiele erfasst. Sie erweitern das Evaluierungsset, und Schwellenwerte oder Prompts ändern sich erst, wenn die neue Version es besteht.

Komponenten

Was wir bauen würden

  1. Eingang und Kanal-Konnektoren

    Konnektoren für Postfach, Scanner, Portal und E-Formulare, die jedes Dokument mit Metadaten und Vorgangsreferenz in eine Warteschlange liefern.

    Umgesetzt durchIntegrationen & APIs

  2. Dienst für Klassifizierung und Extraktion

    Layoutbewusste OCR und modellbasierte Extraktion in versionierte Schemata je Dokumenttyp, mit Konfidenz je Feld und Koordinaten in der Quelle.

    Umgesetzt durchKI-Engineering & generative KI

  3. Regel- und Validierungs-Engine

    Geschäftsregeln, Stammdatenabfragen und Dublettenprüfungen als testbarer Code, den Ihre Prozessverantwortlichen lesen können.

    Umgesetzt durchUnternehmenssoftware & SaaS

  4. Prüfarbeitsplatz

    Eine Warteschlange und eine Prüfansicht mit Dokument und Werten nebeneinander, mit Korrektur per Tastatur, Begründungscodes und optionalem Vier-Augen-Prinzip.

    Umgesetzt durchUnternehmenssoftware & SaaS

  5. Evaluierung und Monitoring

    Ein gelabeltes Validierungsset, Release-Gates und Dashboards für Dunkelverarbeitungsquote, Ausnahmegründe und Abweichungen in der Feldgenauigkeit.

    Umgesetzt durchDaten & Analytics

  6. Hosting und Schriftgutkontrollen

    Betrieb in Ihrem Cloud-Mandanten oder Ihrer Region, Verschlüsselung, Aufbewahrungsklassen und Löschjobs gemäß Ihren Aufbewahrungsrichtlinien.

    Umgesetzt durchCloud- & Plattform-Engineering

Integrationen

Eingänge und Integrationen

Eingänge und Kanäle

  • Funktionspostfächer und E-Mail-Anhänge
  • Scanstationen und Stapel aus der Poststelle
  • Uploads in Bürger- oder Kundenportalen
  • E-Formulare und strukturierte Einreichungen
  • Peppol-E-Rechnungen (UBL)
  • Dokumentenmanagement- und Archivsysteme

Kern der Lösung

Intelligente Dokumentenverarbeitung

Angebundene Systeme

  • Salesforce Fallmanagement und Public Sector SolutionsPlattformSalesforce
  • SAP S/4HANA Finanzen und BeschaffungPlattformSAP
  • Odoo Buchhaltung und EinkaufPlattformOdoo
  • Schriftgutverwaltung und Archiv
  • Stammdatenverzeichnisse (Kunden, Lieferanten, USt, IBAN)
  • Identitätsanbieter für Prüfrollen

Kontrollen

Eingebaute Kontrollen

Zugriffsgrenzen

Prüfende sehen nur die Dokumenttypen und Vorgänge, die ihre Rolle erlaubt. Extraktionsdienste laufen ohne dauerhaften Zugriff auf das Fachsystem; die Übergabe nutzt je Integration ein eng berechtigtes Dienstkonto.

Menschliche Prüfung

Konfidenzschwellen und Regelverstöße leiten Fälle an eine Person. Schwellenwerte werden je Feld festgelegt, nicht je Dokument, und nur gesenkt, wenn das Evaluierungsset zeigt, dass es sicher ist. Entscheidungen über Anträge bleiben bei der Sachbearbeitung.

Nachvollziehbarkeit

Für jedes Feld protokollieren wir Fundstelle, extrahierten Wert, Konfidenz, Regelergebnisse, Modell- und Prompt-Version sowie jede Änderung durch die Prüfung mit Begründungscode.

Datenschutz

Personenbezogene Daten werden beim Eingang minimiert, Schwärzung steht für Auskunftsersuchen bereit, und Aufbewahrung und Löschung folgen Ihrem Aufbewahrungsplan. Die Verarbeitung bleibt in der vereinbarten Region.

KI-Transparenz

Modell- und Prompt-Versionen werden mit ihren Evaluierungsergebnissen dokumentiert. Wo Ergebnisse Menschen betreffen, wird der KI-Einsatz in Ihrem KI-Register erfasst und im Hinweis an Antragstellende erläutert.

Kennzahlen

Was wir messen würden

Diese Kennzahlen stimmen wir in der Analysephase mit Ihnen ab und erfassen zuerst eine Ausgangsbasis Ihres aktuellen Prozesses.

Was wir messen würden
KennzahlWarum sie zähltWie wir sie messen würden
DunkelverarbeitungsquoteWarum sie zähltZeigt je Dokumenttyp, wie viel Routinearbeit keine Person mehr braucht.Wie wir sie messen würdenAnteil der Dokumente, die jede Schwelle und jede Regel ohne Prüfung bestehen, aus den Prozessprotokollen.
Ausnahmequote und GründeWarum sie zähltZeigt, ob Ausnahmen aus schlechten Scans, fehlenden Daten oder anpassungsbedürftigen Regeln entstehen.Wie wir sie messen würdenVolumen der Prüfwarteschlange nach Begründungscode, je Kanal und Dokumenttyp.
Genauigkeit je FeldWarum sie zähltDas Qualitätsmaß, auf das es für nachgelagerte Entscheidungen und Zahlungen ankommt.Wie wir sie messen würdenPrecision und Recall je Feld auf einem vereinbarten, gelabelten Validierungsset, bei jedem Release erneut ausgeführt.
BearbeitungszeitWarum sie zähltErfasst den eingesparten Aufwand und den Aufwand, der in die Prüfung verlagert wird.Wie wir sie messen würdenZeit vom Eingang bis zur Übergabe sowie aktive Prüfzeit je Ausnahme, aus den Zeitstempeln der Warteschlange.

Ziele werden erst nach einer Ausgangsmessung festgelegt.

Einführung

So würden wir die Einführung gestalten

  1. Phase 01

    Analyse und Ausgangsbasis

    Zwei oder drei Dokumenttypen, ein Kanal, Ihre aktuellen Mengen und Fehlermuster. Wir labeln ein Validierungsset aus echten, anonymisierten Dokumenten.

    Abschlusskriterien

    • Felder, Regeln und Qualitätskriterien vereinbart
    • Ausgangsbasis gemessen
    • Datenschutz-Folgenabschätzung begonnen
  2. Phase 02

    Pilot im Schattenbetrieb

    Das System extrahiert und validiert parallel zum bestehenden Prozess; die Mitarbeitenden arbeiten weiter wie bisher und vergleichen.

    Abschlusskriterien

    • Feldgenauigkeit erfüllt die vereinbarten Kriterien
    • Schwellenwerte je Feld festgelegt
    • Prüfende am Arbeitsplatz geschult
  3. Phase 03

    Kontrollierter Produktivbetrieb

    Dunkelverarbeitung für die pilotierten Dokumenttypen aktiviert, mit Stichproben aus automatisch freigegebenen Fällen.

    Abschlusskriterien

    • Stichproben zeigen keine inakzeptablen Fehler
    • Betriebshandbuch und Monitoring übergeben
    • Rollback getestet
  4. Phase 04

    Skalierung

    Weitere Dokumenttypen, Kanäle und Sprachen, die jeweils dieselbe Evaluierung bestehen müssen, bevor sie live gehen.

    Abschlusskriterien

    • Evaluierungsset je neuem Typ
    • Verantwortung bei Ihrem Team

Wo die Lösung passt

  • Öffentlicher Sektor & Verwaltung

    Genehmigungs-, Förder- und Leistungsanträge mit ihren Anlagen; Informationsfreiheitsanfragen, bei denen Dokumente vor der Herausgabe geschwärzt werden müssen.

  • Finanzdienstleistungen

    KYC-Akten, Schadenunterlagen und Lieferantenrechnungen, mit Vier-Augen-Prüfung bei hohen Beträgen.

  • Gesundheitswesen & Life Sciences

    Überweisungsschreiben, Erstattungsformulare und Lieferantenzertifikate, mit strengem rollenbasiertem Zugriff.

  • Fertigung & Industrie

    Lieferscheine, Konformitätsbescheinigungen und Zolldokumente, abgeglichen mit Bestellungen.

Beispiel zur Veranschaulichung

Beihilfeanträge in einer Landesverwaltung

Ausgangslage
Eine Beihilfestelle erhält täglich Anträge mit Arztrechnungen und Rezepten als Papier, Scan oder Foto aus der App. Sachbearbeitende tippen Beträge, Daten und Leistungsziffern ab, bevor sie über die Erstattung entscheiden.
System
Ein Eingang, der Belege klassifiziert, Beträge, Leistungsdaten und Rechnungssteller extrahiert, gegen die Beihilferegeln prüft und den Vorgang vorbefüllt im Fachverfahren anlegt.
Menschliche Kontrolle
Die Sachbearbeitung entscheidet über jede Erstattung; Felder mit geringer Konfidenz und auffällige Belege werden markiert und zur Prüfung vorgelegt.
Was wir messen würden
Anteil der ohne Nachtippen erfassten Belege, Feldgenauigkeit auf einem gekennzeichneten Prüfdatensatz, Bearbeitungszeit je Antrag.

Deutschland

Vom Posteingang in die E-Akte

In deutschen Verwaltungen und Unternehmen kommt vieles noch als Papier, Scan oder PDF an, obwohl strukturierte Formate längst verbreitet sind. Seit 2025 müssen Unternehmen E-Rechnungen im Format XRechnung oder ZUGFeRD empfangen können; solche Rechnungen brauchen keine Extraktion, sondern eine direkte Prüfung. Alles andere durchläuft Klassifizierung, Extraktion und Regelprüfung, bevor es in die E-Akte, das Fachverfahren oder SAP gelangt.

Wo extrahierte Daten in Entscheidungen über Menschen einfließen, planen wir mit DSGVO und KI-Verordnung: dokumentierte Verarbeitung, menschliche Prüfung und Protokolle, die Datenschutz und Revision nachvollziehen können.

Fragen zur intelligenten Dokumentenverarbeitung

Wie genau ist die Extraktion?

Das hängt von Ihren Dokumenten ab, deshalb messen wir sie, statt sie zu versprechen. Wir labeln ein Validierungsset aus Ihren eigenen anonymisierten Dokumenten und weisen Precision und Recall je Feld aus. KI-Ergebnisse können falsch sein, deshalb gehen unsichere Felder an eine Person statt direkt in das Fachsystem.

Kommt das System mit Handschrift, schlechten Scans und mehreren Sprachen zurecht?

Handschriftliche Formulare und schlechte Scans lassen sich lesen, allerdings mit geringerer Konfidenz, sodass mehr davon in der Prüfwarteschlange landen. Dokumente in verschiedenen Sprachen werden zuerst nach Sprache klassifiziert, damit jedes das richtige Schema und die richtigen Regeln erhält.

Wir haben bereits OCR oder eine Erfassungslösung. Ersetzen wir sie?

Nicht unbedingt. Funktioniert Ihre Erfassungsschicht, bauen wir Validierung, Prüfung und Übergabe darum herum und ergänzen modellbasierte Extraktion nur für die Dokumenttypen, bei denen sie einen Mehrwert bringt.

Trifft das System Entscheidungen über Anträge oder Schadenfälle?

Nein. Es bereitet Daten auf und prüft sie. Entscheidungen mit rechtlicher oder finanzieller Wirkung bleiben bei Ihrer Sachbearbeitung, im Einklang mit Artikel 22 DSGVO und Ihren eigenen Richtlinien.

Wo werden Dokumente verarbeitet und gespeichert?

In der Cloud-Region oder dem Rechenzentrum Ihrer Wahl. Wir dokumentieren jeden Verarbeitungsschritt, einschließlich etwaiger externer Modelldienste, damit Ihre Datenschutzbeauftragten ihn vor dem Go-live bewerten können.

Was ist ein sinnvoller erster Umfang?

Ein Dokumenttyp mit hohem Volumen und klaren Regeln, etwa Lieferantenrechnungen oder ein einzelnes Antragsformular. Er belegt Ablauf, Prüfansicht und Messungen, bevor weitere Typen hinzukommen. Mehr über unsere Vorgehensweise.

Sprechen Sie mit uns über Ihre Dokumentenflüsse

Bringen Sie zwei oder drei Dokumentarten mit und die Systeme, in denen sie landen, ob E-Akte, Fachverfahren oder SAP. Wir zeigen, wie ein erstes Release aussehen könnte.