Automatisierte Due Diligence: Von Tagen zu Minuten mit Lokaler KI-Verarbeitung

Die Corporate Due Diligence ist eine Übung in Geduld. Ein Analyst erhält ein Paket von 30 bis 50 Dokumenten pro Unternehmen: Gründungsurkunden, Vollmachten, Ausweise der Gesellschafter, Adressnachweise, Jahresabschlüsse, Handelsregisterauszüge, steuerliche Unbedenklichkeitsbescheinigungen. Er muss jedes einzelne öffnen, lesen, Schlüsseldaten extrahieren, Informationen zwischen Dokumenten abgleichen, Inkonsistenzen erkennen und einen Bericht erstellen.

Mit einem Paket dauert es einen Tag. Mit 10 Paketen in der Warteschlange dauert es zwei Wochen. Und wenn der Deal eine Frist hat, wird die Due Diligence zum Engpass, der alles verzögert.

Was bei einer typischen Due Diligence extrahiert wird

Die Daten, die ein Analyst in jedem Paket sucht, sind vorhersehbar:

Aus den Gründungsurkunden: Firmenname, Rechtsform, Gründungsdatum, Unternehmenszweck, Stammkapital, Adresse, Notardaten, Urkundennummer.

Aus den Gesellschafterverzeichnissen: Namen der Gesellschafter oder Aktionäre, Beteiligungsquoten, Staatsangehörigkeit, Identifizierung des wirtschaftlich Berechtigten (UBO) — wer direkt oder indirekt mehr als 25% des Unternehmens kontrolliert.

Aus den Ausweisen: Vollständiger Name, Geburtsdatum, Dokumentennummer, Ablaufdatum. Abgleich mit der Gesellschafterliste zur Überprüfung, dass die als Gesellschafter aufgeführten Personen dieselben sind, die einen Ausweis vorlegen.

Aus den Steuerunterlagen: Steuer-ID oder Äquivalent, steuerlicher Sitz, Steuerregime, Compliance-Status.

Aus den Jahresabschlüssen: Gesamtvermögen, Umsatz, Nettogewinn, Verschuldung, wichtige Finanzkennzahlen.

Jeder dieser Datenpunkte wird manuell in Dokumenten gesucht, die jedes Format, jede Sprache und jede Scan-Qualität haben können.

Warum traditionelle Automatisierung nicht funktioniert

Die erste Reaktion vieler Teams ist: „Kaufen wir eine OCR-Software." Das Problem ist, wie wir in einem anderen Artikel erläutert haben, dass vorlagenbasiertes OCR bei Dokumenten mit variablem Format nicht funktioniert.

Eine Gründungsurkunde von 1998 aus Nuevo León sieht völlig anders aus als eine von 2024 aus Mexiko-Stadt. Ein mexikanischer Reisepass sieht völlig anders aus als ein amerikanischer. Eine steuerliche Unbedenklichkeitsbescheinigung des SAT sieht völlig anders aus als ein EIN-Bestätigungsschreiben des IRS.

Vorlagenbasiertes OCR erfordert eine Vorlage für jede Formatvariation. Bei Due Diligence, wo Sie Dokumente aus mehreren Gerichtsbarkeiten, Notariaten und Zeiträumen erhalten, ist die Anzahl der Variationen nicht handhabbar.

Kontextuelle KI für Due Diligence

Die Lösung besteht in der Verwendung von Sprachmodellen, die den Inhalt des Dokuments unabhängig von seinem Format verstehen. Das Modell liest eine Gründungsurkunde und versteht, dass es eine Gründungsurkunde liest — es identifiziert die relevanten Abschnitte, extrahiert strukturierte Daten und gibt sie in einem konsistenten Format zurück.

Der vollständige Ablauf für ein Due-Diligence-Paket:

Massenupload. Der Analyst lädt alle Dokumente des Pakets auf einmal hoch. Keine Notwendigkeit, sie zu klassifizieren oder spezifisch zu benennen.

Automatische Klassifizierung. Das System identifiziert, welcher Dokumenttyp jede Datei ist: Gründungsurkunde, Ausweis, Adressnachweis, Vollmacht, Jahresabschluss.

OCR und Extraktion. Gescannte Dokumente durchlaufen spezialisiertes OCR. Digitale werden direkt verarbeitet. Jedes Dokument wird mit einem für seinen Typ spezialisierten Prompt analysiert.

Kreuzvalidierung. Daten aus verschiedenen Dokumenten werden automatisch abgeglichen. Die Gesellschafternamen in der Gründungsurkunde werden mit den vorgelegten Ausweisen mittels Fuzzy Matching verglichen (um Variationen wie „Juan Pérez" vs. „Juan Manuel Pérez García" zu berücksichtigen). Die Beteiligungsquoten werden summiert, um zu überprüfen, dass sie 100% ergeben. Wirtschaftlich Berechtigte, die den regulatorischen Schwellenwert überschreiten, werden markiert.

Strukturierter Bericht. Die extrahierten und validierten Daten werden in einer konsolidierten Ansicht präsentiert, die der Analyst überprüft, bei Bedarf korrigiert und genehmigt.

Der Datenschutzfaktor

Due-Diligence-Dokumente enthalten äußerst sensible Informationen: Personalausweise, Steuerdaten, Gesellschafterstruktur, vertrauliche Finanzinformationen. Dies sind genau die Art von Dokumenten, die nicht auf Servern Dritter verarbeitet werden sollten.

Wenn das Analysesystem diese Dokumente an eine Cloud-API sendet, reisen die Daten des geprüften Unternehmens — und aller damit verbundenen Personen — durch das Internet und werden auf Infrastruktur verarbeitet, die der Analyst nicht kontrolliert.

Für Kanzleien, Investmentfonds und Finanzinstitute kann dies ein Verstoß gegen ihre Vertraulichkeitspflichten gegenüber dem Mandanten, gegen Datenschutzvorschriften und gegen Geldwäschebekämpfungsvorschriften sein, die Kontrollen über den Umgang mit sensiblen Informationen verlangen.

Die private Verarbeitung beseitigt dieses Risiko vollständig. Dokumente werden auf einem Server innerhalb des Netzwerks der Kanzlei oder Institution verarbeitet. OCR- und Sprachmodelle laufen lokal. Keine Daten verlassen das Netzwerk.

Erkennung wirtschaftlich Berechtigter

Die Identifizierung des wirtschaftlich Berechtigten (Ultimate Beneficial Owner / UBO) ist eine regulatorische Anforderung in Mexiko und den meisten Rechtsordnungen. Jede natürliche Person, die direkt oder indirekt mehr als 25% des Kapitals besitzt oder effektive Kontrolle über das Unternehmen ausübt, muss identifiziert werden.

Bei einfachen Unternehmensstrukturen ist dies unkompliziert. Bei Strukturen mit mehreren Unternehmensebenen, Tochtergesellschaften und Treuhandverhältnissen kann die Kontrollkette lang und undurchsichtig sein.

Der automatische Datenabgleich ermöglicht es, die Kette zu verfolgen: Unternehmen A hat Unternehmen B als Gesellschafter (60%). Unternehmen B hat Juan Pérez als Gesellschafter (45%). Also kontrolliert Juan Pérez indirekt 27% von Unternehmen A (60% × 45%) und ist wirtschaftlich Berechtigter.

Diese Berechnung, die manuell Diagramme und Tabellenkalkulationen erfordert, erfolgt automatisch, wenn die Daten auf jeder Ebene der Kette strukturiert sind.

Fullkro: Due Diligence mit privater KI

Bei Leeuwwolk haben wir Fullkro entwickelt, um genau diesen Prozess zu automatisieren. Das System verarbeitet komplette Dokumentenpakete, extrahiert strukturierte Daten mit kontextueller KI, gleicht Informationen zwischen Dokumenten ab, erkennt wirtschaftlich Berechtigte und erstellt konsolidierte Berichte.

Das OCR-Modell wurde mit über 950 echten mexikanischen Rechtsdokumenten trainiert. Leeuwwolk garantiert die Privatsphäre der Dokumente Ihrer Mandanten: Verschlüsselung bei der Übertragung und im Ruhezustand, ohne Daten mit Dritten zu teilen, ohne Informationen an öffentliche KI-Dienste zu senden.

→ Erfahren Sie mehr über Fullkro und beschleunigen Sie Ihre Due Diligence

Leeuwwolk ist ein mexikanisches Unternehmen, das sich auf private künstliche Intelligenz für den Rechts- und Finanzsektor spezialisiert hat.