Dokumente rein, geprüfte Daten raus. Über Ausnahmen entscheiden Menschen.
Anträge, Rechnungen, Schadenmeldungen und Briefe kommen in jedem Format an. Wir entwickeln Eingangsprozesse, die jedes Dokument klassifizieren, die relevanten Felder extrahieren, sie gegen Ihre Regeln prüfen und nur die unsicheren Fälle an eine Person geben.
Für belgische Verwaltungen und Unternehmen, deren Post in drei Sprachen ankommt und deren Werte nachvollziehbar bleiben müssen.
Dokumente werden aus allen Kanälen erfasst und vom System klassifiziert, extrahiert und validiert. Fälle unterhalb der Konfidenzschwelle oder mit verletzter Regel gehen in einer Prüfwarteschlange an eine Person. Validierte Daten werden an das Fachsystem übergeben, und Korrekturen aus der Prüfung fließen in das Evaluierungsset ein.
Vorher und nachher
Was sich im Arbeitsalltag ändert
Heute
Mit dem System
Heute
Heute: Abtippen aus Anhängen
Mitarbeitende öffnen jedes PDF, jeden Scan und jedes E-Formular und übertragen Namen, Beträge und Referenzen von Hand in das Fachverfahren oder das ERP.
Mit dem System
Mit dem System: Daten kommen strukturiert an
Felder werden mit ihrer Position im Quelldokument extrahiert, sodass die prüfende Person Wert und Beleg nebeneinander sieht.
Heute
Heute: Fehler fallen spät auf
Fehlende Seiten und widersprüchliche Daten zeigen sich erst Wochen später, wenn eine Entscheidung angefochten wird oder eine Zahlung zurückkommt.
Mit dem System
Mit dem System: Regeln greifen schon beim Eingang
Vollständigkeit, Abgleich mit Stammdaten und Geschäftsregeln werden geprüft, bevor ein Vorgang angelegt wird, solange beim Absender noch nachgefragt werden kann.
Eine saubere, vollständige Rechnung dauert so lange wie eine unübersichtliche, mehrdeutige.
Mit dem System
Mit dem System: Aufmerksamkeit für die Ausnahmen
Saubere Dokumente laufen direkt durch. Menschen bearbeiten eine Warteschlange mit den unsicheren und ungewöhnlichen Fällen, jeweils mit dem Grund, warum sie dort liegen.
Heute
Heute: Kein Nachweis, wie Daten erfasst wurden
Fragt die Revision, woher ein Wert stammt, hängt die Antwort davon ab, wer ihn eingegeben hat.
Mit dem System
Mit dem System: Jeder Wert ist nachvollziehbar
Quelldokument, Extraktion, Konfidenz, Regelergebnisse und Änderungen durch die Prüfung werden für jedes Feld protokolliert.
Workflow
So läuft der Prozess
Sieben Schritte, ein Ausnahmepfad. Schwellenwerte und Regeln werden mit Ihren Prozessverantwortlichen abgestimmt und an Ihren eigenen Dokumenten justiert, bevor etwas produktiv läuft.
Beispielhafter Ablauf
7 Schritte · 1 menschliche Prüfung
Legende
System
Person
Menschliche Prüfung
Ausnahmepfad
Intelligente Dokumentenverarbeitung: beispielhafter Ablauf mit Ausnahmepfad
Diagramm als Text lesen
Der Hauptpfad führt von der Erfassung über Klassifizierung, Extraktion und Validierung zur Übergabe an das Fachsystem und endet mit dem Lernen aus Korrekturen.
Nach der Validierung verlässt jedes Dokument mit einem Feld unterhalb der Konfidenzschwelle oder einer verletzten Geschäftsregel den Hauptpfad und geht in die Prüfwarteschlange, wo eine Person die Werte bestätigt oder korrigiert. Geprüfte Dokumente kehren beim Übergabeschritt auf den Hauptpfad zurück.
Die Prüfwarteschlange ist der menschliche Kontrollpunkt: Unsichere Werte erreichen das Fachsystem nie ohne eine Person.
01
Schritt 1: Aus allen Kanälen erfassenSystem
Scans, E-Mail-Anhänge, Portal-Uploads und E-Formulare landen in einer gemeinsamen Eingangswarteschlange, mit Vorgangsreferenz, Kanal-Metadaten und Prüfsumme. Strukturierte E-Rechnungen (Peppol UBL) überspringen die Extraktion und gehen direkt in die Validierung.
02
Schritt 2: Trennen und klassifizierenSystem
Sammelsendungen aus mehreren Dokumenten werden in ihre Bestandteile getrennt. Jeder Teil wird nach Dokumenttyp und Sprache klassifiziert, was das Extraktionsschema und das passende Regelwerk bestimmt.
03
Schritt 3: Felder extrahierenSystem
Layoutbewusste Texterkennung (OCR) liest die Seite; ein Sprachmodell extrahiert die vereinbarten Felder in ein striktes Schema. Jedes Feld trägt einen Konfidenzwert und seine Position in der Quelle.
04
Schritt 4: Gegen Regeln prüfenSystem
Werte werden gegen Stammdaten (Kunden-, Lieferanten-, USt- und IBAN-Verzeichnisse), feldübergreifende Regeln und Dubletten geprüft. Felder oberhalb der vereinbarten Konfidenzschwelle, die jede Regel bestehen, laufen direkt durch.
05
Schritt 5: PrüfwarteschlangePerson
Die prüfende Person sieht Dokument und extrahierte Werte nebeneinander, die verletzte Regel oder das Feld mit geringer Konfidenz ist hervorgehoben, und bestätigt oder korrigiert die Werte.
Ausnahmepfad: Unter Schwellenwert oder Regel verletzt· Zurück zu Schritt 6
Menschliche Prüfung
Unsichere Werte erreichen das Fachsystem nie ohne eine Person. Prüfende können ein Dokument auch zurückweisen und beim Absender ein neues anfordern.
06
Schritt 6: An das Fachsystem übergebenSystem
Validierte Daten legen den Vorgang im Fallmanagement, im CRM oder im ERP über dessen API an oder aktualisieren ihn, mit angehängtem Quelldokument und gesetzter Aufbewahrungsklasse.
07
Schritt 7: Aus Korrekturen lernenSystem
Korrekturen aus der Prüfung werden als gelabelte Beispiele erfasst. Sie erweitern das Evaluierungsset, und Schwellenwerte oder Prompts ändern sich erst, wenn die neue Version es besteht.
Komponenten
Was wir bauen würden
01
Eingang und Kanal-Konnektoren
Konnektoren für Postfach, Scanner, Portal und E-Formulare, die jedes Dokument mit Metadaten und Vorgangsreferenz in eine Warteschlange liefern.
Eine Warteschlange und eine Prüfansicht mit Dokument und Werten nebeneinander, mit Korrektur per Tastatur, Begründungscodes und optionalem Vier-Augen-Prinzip.
Prüfende sehen nur die Dokumenttypen und Vorgänge, die ihre Rolle erlaubt. Extraktionsdienste laufen ohne dauerhaften Zugriff auf das Fachsystem; die Übergabe nutzt je Integration ein eng berechtigtes Dienstkonto.
Menschliche Prüfung
Konfidenzschwellen und Regelverstöße leiten Fälle an eine Person. Schwellenwerte werden je Feld festgelegt, nicht je Dokument, und nur gesenkt, wenn das Evaluierungsset zeigt, dass es sicher ist. Entscheidungen über Anträge bleiben bei der Sachbearbeitung.
Nachvollziehbarkeit
Für jedes Feld protokollieren wir Fundstelle, extrahierten Wert, Konfidenz, Regelergebnisse, Modell- und Prompt-Version sowie jede Änderung durch die Prüfung mit Begründungscode.
Datenschutz
Personenbezogene Daten werden beim Eingang minimiert, Schwärzung steht für Auskunftsersuchen bereit, und Aufbewahrung und Löschung folgen Ihrem Aufbewahrungsplan. Die Verarbeitung bleibt in der vereinbarten Region.
KI-Transparenz
Modell- und Prompt-Versionen werden mit ihren Evaluierungsergebnissen dokumentiert. Wo Ergebnisse Menschen betreffen, wird der KI-Einsatz in Ihrem KI-Register erfasst und im Hinweis an Antragstellende erläutert.
Kennzahlen
Was wir messen würden
Diese Kennzahlen stimmen wir in der Analysephase mit Ihnen ab und erfassen zuerst eine Ausgangsbasis Ihres aktuellen Prozesses.
Was wir messen würden
Kennzahl
Warum sie zählt
Wie wir sie messen würden
01Dunkelverarbeitungsquote
Warum sie zähltZeigt je Dokumenttyp, wie viel Routinearbeit keine Person mehr braucht.
Wie wir sie messen würdenAnteil der Dokumente, die jede Schwelle und jede Regel ohne Prüfung bestehen, aus den Prozessprotokollen.
02Ausnahmequote und Gründe
Warum sie zähltZeigt, ob Ausnahmen aus schlechten Scans, fehlenden Daten oder anpassungsbedürftigen Regeln entstehen.
Wie wir sie messen würdenVolumen der Prüfwarteschlange nach Begründungscode, je Kanal und Dokumenttyp.
03Genauigkeit je Feld
Warum sie zähltDas Qualitätsmaß, auf das es für nachgelagerte Entscheidungen und Zahlungen ankommt.
Wie wir sie messen würdenPrecision und Recall je Feld auf einem vereinbarten, gelabelten Validierungsset, bei jedem Release erneut ausgeführt.
04Bearbeitungszeit
Warum sie zähltErfasst den eingesparten Aufwand und den Aufwand, der in die Prüfung verlagert wird.
Wie wir sie messen würdenZeit vom Eingang bis zur Übergabe sowie aktive Prüfzeit je Ausnahme, aus den Zeitstempeln der Warteschlange.
Ziele werden erst nach einer Ausgangsmessung festgelegt.
Einführung
So würden wir die Einführung gestalten
Phase 01
Analyse und Ausgangsbasis
Zwei oder drei Dokumenttypen, ein Kanal, Ihre aktuellen Mengen und Fehlermuster. Wir labeln ein Validierungsset aus echten, anonymisierten Dokumenten.
Abschlusskriterien
Felder, Regeln und Qualitätskriterien vereinbart
Ausgangsbasis gemessen
Datenschutz-Folgenabschätzung begonnen
Phase 02
Pilot im Schattenbetrieb
Das System extrahiert und validiert parallel zum bestehenden Prozess; die Mitarbeitenden arbeiten weiter wie bisher und vergleichen.
Abschlusskriterien
Feldgenauigkeit erfüllt die vereinbarten Kriterien
Schwellenwerte je Feld festgelegt
Prüfende am Arbeitsplatz geschult
Phase 03
Kontrollierter Produktivbetrieb
Dunkelverarbeitung für die pilotierten Dokumenttypen aktiviert, mit Stichproben aus automatisch freigegebenen Fällen.
Abschlusskriterien
Stichproben zeigen keine inakzeptablen Fehler
Betriebshandbuch und Monitoring übergeben
Rollback getestet
Phase 04
Skalierung
Weitere Dokumenttypen, Kanäle und Sprachen, die jeweils dieselbe Evaluierung bestehen müssen, bevor sie live gehen.
Genehmigungs-, Förder- und Leistungsanträge mit ihren Anlagen; Informationsfreiheitsanfragen, bei denen Dokumente vor der Herausgabe geschwärzt werden müssen.
Lieferscheine, Konformitätsbescheinigungen und Zolldokumente, abgeglichen mit Bestellungen.
Beispiel zur Veranschaulichung
Zuschussanträge in einer Gemeinschaftsverwaltung
Ausgangslage
Eine Verwaltung der Deutschsprachigen Gemeinschaft erhält Anträge auf Zuschüsse mit gescannten Nachweisen, überwiegend auf Deutsch, teils auf Französisch. Die Sachbearbeitung verbringt mehr Zeit mit der Prüfung der Vollständigkeit als mit der Bewertung.
System
Eine Eingangsstrecke, die Nachweise klassifiziert, Kernangaben ausliest, die Unternehmensnummer abgleicht, fehlende Unterlagen meldet und einen Entwurf der Nachforderung im Fachsystem vorbereitet.
Menschliche Kontrolle
Die Sachbearbeitung prüft unsichere Felder und entscheidet über Zulässigkeit und Bewilligung; das System bereitet nur vor.
Was wir messen würden
Zeit bis zum vollständigen Antrag, Anteil der Anträge ohne Nachforderung und Feldgenauigkeit auf einem geprüften Testset.
Belgien
Ein Posteingang für drei Sprachen
In Belgien kommt dasselbe Dokument in drei Sprachen und vielen Fassungen an: Bescheinigungen der Krankenkassen, Auszüge aus der Zentralen Datenbank der Unternehmen, Rechnungen, Anträge auf Zuschüsse. Wir gestalten eine Eingangs- und Ausleseschicht mit Schemata je Dokumentart und Sprache, sodass alles denselben kontrollierten Weg nimmt.
Strukturierte Peppol-Rechnungen überspringen das Auslesen ganz. Wo ausgelesene Daten Entscheidungen über Menschen vorbereiten, planen wir mit DSGVO und KI-Verordnung: dokumentierte Verarbeitung, menschliche Prüfung und Protokolle, die die Datenschutzbehörde oder Ihre Revision nachvollziehen kann.
Das hängt von Ihren Dokumenten ab, deshalb messen wir sie, statt sie zu versprechen. Wir labeln ein Validierungsset aus Ihren eigenen anonymisierten Dokumenten und weisen Precision und Recall je Feld aus. KI-Ergebnisse können falsch sein, deshalb gehen unsichere Felder an eine Person statt direkt in das Fachsystem.
02Kommt das System mit Handschrift, schlechten Scans und mehreren Sprachen zurecht?
Handschriftliche Formulare und schlechte Scans lassen sich lesen, allerdings mit geringerer Konfidenz, sodass mehr davon in der Prüfwarteschlange landen. Dokumente in verschiedenen Sprachen werden zuerst nach Sprache klassifiziert, damit jedes das richtige Schema und die richtigen Regeln erhält.
03Wir haben bereits OCR oder eine Erfassungslösung. Ersetzen wir sie?
Nicht unbedingt. Funktioniert Ihre Erfassungsschicht, bauen wir Validierung, Prüfung und Übergabe darum herum und ergänzen modellbasierte Extraktion nur für die Dokumenttypen, bei denen sie einen Mehrwert bringt.
04Trifft das System Entscheidungen über Anträge oder Schadenfälle?
Nein. Es bereitet Daten auf und prüft sie. Entscheidungen mit rechtlicher oder finanzieller Wirkung bleiben bei Ihrer Sachbearbeitung, im Einklang mit Artikel 22 DSGVO und Ihren eigenen Richtlinien.
05Wo werden Dokumente verarbeitet und gespeichert?
In der Cloud-Region oder dem Rechenzentrum Ihrer Wahl. Wir dokumentieren jeden Verarbeitungsschritt, einschließlich etwaiger externer Modelldienste, damit Ihre Datenschutzbeauftragten ihn vor dem Go-live bewerten können.
06Was ist ein sinnvoller erster Umfang?
Ein Dokumenttyp mit hohem Volumen und klaren Regeln, etwa Lieferantenrechnungen oder ein einzelnes Antragsformular. Er belegt Ablauf, Prüfansicht und Messungen, bevor weitere Typen hinzukommen. Mehr über unsere Vorgehensweise.
Sprechen wir über Ihre Dokumentenflüsse
Bringen Sie zwei oder drei Dokumentarten mit und die Systeme, in denen sie landen. Wir zeigen ein erstes Release, das alle drei Landessprachen beherrscht.