Insight
EIOPA verlangt menschliche Aufsicht über KI-Systeme. Warum pauschale Freigaben nichts prüfen und wie risikobasierte Stufen Kontrolle und Tempo verbinden.
Kernaussage
Menschliche Aufsicht wirkt erst, wenn sie nach Risiko geschnitten ist. Eine Freigabe, die jeden Fall gleich behandelt, prüft nichts und bremst alles. Wer Aufsicht als Prozessdesign begreift, gewinnt Kontrolle und Tempo.

Organisation
5 min Lesezeit
Die wichtigsten Erkenntnisse
EIOPA verlangt Aufsicht nach Risiko, nicht nach Schema F.
Pauschale Vier-Augen-Freigabe ist Scheinkontrolle im Akkord.
Korrekturquoten je Fallklasse steuern das Freigabedesign.
Jeder will den Menschen im Loop. Kaum einer sagt, was er dort tut.
In fast jedem KI-Vorhaben eines Versicherers steht der Satz, am Ende entscheide ein Mensch. Eine Freigabe, die jeden Fall gleich behandelt, kontrolliert allerdings nichts, sie verlangsamt nur.
Die menschliche Aufsicht ist zur Beruhigungsformel geworden. Sie steht in der Richtlinie, im Gremienbeschluss und in der Kommunikation an den Betriebsrat. Was sie im Prozess konkret bedeutet, welche Fälle ein Mensch mit welcher Information und welchem Zeitbudget prüft, bleibt dagegen meist offen. Genau dort entscheidet sich, ob KI im Unternehmen skaliert.
Was die Aufsicht tatsächlich verlangt
Die europäische Versicherungsaufsicht EIOPA hat am 6. August 2025 ihre Opinion zu KI-Governance und Risikomanagement veröffentlicht. Sie schafft keine neuen Pflichten, sondern ordnet die bestehenden Regeln des Versicherungsrechts für den KI-Einsatz: Datengovernance, Dokumentation, Fairness, Erklärbarkeit und menschliche Aufsicht, ausdrücklich nach einem risikobasierten und verhältnismäßigen Ansatz.
Der entscheidende Punkt steckt im Wort risikobasiert. Die Aufsicht verlangt keine pauschale Kontrolle jedes Einzelfalls. Sie verlangt, dass das Unternehmen weiß, wo seine KI-Systeme wirken, welche Risiken daraus entstehen und welche Kontrolle dem angemessen ist. Für Hochrisikoanwendungen im Sinne des AI Act, etwa bei der Risikoprüfung in der Lebens- und Krankenversicherung, kommt die Pflicht zur wirksamen menschlichen Aufsicht aus Artikel 14 der Verordnung hinzu.
Die Scheinkontrolle: Durchwinken im Akkord
In der Praxis entsteht oft das Gegenteil von Kontrolle. Ein Sachbearbeiter bekommt zweihundert maschinell vorbereitete Fälle am Tag und klickt sie frei, weil die Maschine in der Regel recht hat. Die Fachwelt nennt das Automation Bias: Je zuverlässiger das System, desto seltener widerspricht der Mensch, bis er faktisch nichts mehr prüft.
Eine solche Freigabe erfüllt die Form und verfehlt den Zweck. Sie kostet Durchlaufzeit, bindet Personal und erzeugt eine Verantwortungsillusion: Im Schadenfall trägt ein Mensch die Unterschrift für eine Entscheidung, die er faktisch nicht geprüft hat. Für das Unternehmen ist das die teuerste aller Varianten, langsam und trotzdem unkontrolliert.
Bemerkenswert ist, wie diese Konstruktion entsteht: selten aus fachlicher Überzeugung, meist aus Vorsicht. Die pauschale Freigabe wirkt im Gremium wie die sichere Wahl, weil niemand ihr widersprechen muss. Dass sie in der Praxis zur Durchwinkstation wird, zeigt sich erst im Betrieb, wenn die Korrekturquote gegen null geht und niemand fragt, warum.
Risikobasiert schneiden: drei Stufen der Freigabe
Wirksame Aufsicht beginnt mit einer Sortierung der Fälle nach Risiko und Unsicherheit. In der Praxis bewähren sich drei Stufen. Die erste Stufe läuft dunkel: eindeutige Fälle mit hoher Modellsicherheit und geringem Schadenpotenzial werden automatisch verarbeitet und stichprobenhaft nachgeprüft. Die zweite Stufe ist die gezielte Einzelfreigabe: Fälle, in denen das System unsicher ist oder der Fall vom gewohnten Muster abweicht, gehen mit Begründung an einen Menschen. Die dritte Stufe ist die Eskalation: Fälle mit hohem Risiko oder Ermessensspielraum landen bei erfahrenen Kräften mit Zeit für eine echte Prüfung.
Der Unterschied zur pauschalen Vier-Augen-Prüfung liegt in der Verteilung der Aufmerksamkeit. Der Mensch prüft dort, wo seine Prüfung Wert stiftet, und wird dort herausgenommen, wo er nur noch abnickt. Welche Prozesse dafür zuerst infrage kommen, zeigt unsere Einordnung zur Dunkelverarbeitung im Schaden.
Was der Prüfende sehen muss
Eine Freigabe ist nur so gut wie die Information, auf der sie beruht. Wer freigeben soll, braucht drei Dinge auf einen Blick: was das System entschieden hätte, warum es so entschieden hätte, und welche Signale gegen die Entscheidung sprechen. Fehlt die Begründung, bleibt dem Menschen nur Vertrauen oder Misstrauen, beides ist keine Prüfung.
Genauso wichtig ist das Recht auf Widerspruch ohne Reibung. Wenn das Ablehnen einer Systemempfehlung drei Begründungsfelder und eine Rückfrage des Vorgesetzten auslöst, während das Bestätigen ein Klick ist, hat die Organisation die Antwort vorentschieden. Die Prozesskosten einer Korrektur müssen so niedrig sein wie die einer Bestätigung.
Dazu gehört die Protokollierung: Wer hat wann was freigegeben, abgelehnt oder geändert? Diese Daten sind nicht nur Pflicht gegenüber der Aufsicht, sie sind das Lernmaterial, mit dem das Unternehmen seine Freigabestufen laufend nachjustiert. Eine hohe Korrekturquote in einer Fallklasse ist ein Signal, das Modell oder die Stufengrenze zu prüfen.
Die Organisation hinter der Freigabe
Freigabedesign ist keine IT-Aufgabe. Es verlangt Entscheidungen, die nur Fachbereich und Vorstand treffen können: Welche Fallklassen dürfen dunkel laufen? Wer trägt die Verantwortung je Stufe? Wie viel Zeit ist für eine echte Prüfung vorgesehen, und wie wird sie in der Personalbemessung berücksichtigt? Wer darf die Stufengrenzen verschieben, und in welchem Gremium wird das entschieden?
Diese Fragen gehören in die Prozessdokumentation, nicht in eine allgemeine KI-Richtlinie. Die Richtlinie setzt den Rahmen, der Prozess macht ihn wirksam. Wie die Aufsicht auf Governance-Lücken schaut, haben wir in der Analyse der BaFin-Prioritäten für Versicherer beschrieben.
Was das für laufende Vorhaben heißt
Wer heute ein KI-Vorhaben im Antrag, im Schaden oder im Kundenservice treibt, sollte die Freigabelogik als eigenes Arbeitspaket führen, gleichrangig mit Modell und Integration. Konkret: Fallklassen definieren, Stufen festlegen, Informationsbedarf je Stufe klären, Protokollierung aufsetzen, Korrekturquoten als Steuerungsgröße etablieren. Das ist in Wochen zu leisten und erspart Monate an Diskussionen mit Revision, Betriebsrat und Aufsicht. Gerade gegenüber dem Betriebsrat ist ein durchdachtes Freigabedesign das stärkste Argument, denn es beantwortet die Kernfrage der Mitbestimmung, welche Rolle der Mensch künftig hat, konkret statt mit Beschwichtigung.
Der nächste Schritt
Wie belastbar die eigene Freigabelogik ist, zeigt sich in einem Tag strukturierter Durchsicht. In einer Potenzialanalyse gehen wir die laufenden und geplanten KI-Anwendungen durch und ordnen, wo Kontrolle fehlt und wo sie nur bremst. Als Einstieg für den Führungskreis eignet sich ein Impuls-Workshop zur KI-Governance.

Dominik Winkel
Gründungspartner Sotica. Partner für Wandel in der Finanzbranche, seit über 15 Jahren in der Branche.
Ein Gespräch klärt, welcher Schritt der erste ist. Direkt mit dem Gründungspartner, ohne Umwege.


