Fachartikel

Autonomiestufen für KI-Agenten in der Versicherungsverwaltung

assfinet Redaktion · 26. Juli 2026

Die Frage „Darf die KI das selbst entscheiden?” lässt sich für ein Verwaltungssystem nicht pauschal beantworten. Ein eingehendes Dokument einem Vertrag zuzuordnen ist etwas anderes als eine Versicherungssumme zu ändern. Sinnvoll wird die Frage erst, wenn sie pro Vorgangsart gestellt wird – und dafür braucht es ein Stufenmodell.

Die fünf Stufen

Stufe 0 – manuell. Keine KI-Beteiligung. Der Vorgang wird vollständig von Menschen bearbeitet.

Stufe 1 – Empfehlung. Ein Assistent analysiert, fasst zusammen und schlägt vor. Die Ausführung übernimmt ein Mensch. Der Zeitgewinn liegt im Verstehen des Vorgangs, nicht in der Bearbeitung.

Stufe 2 – Vorbereitung mit Freigabe. Ein Agent bearbeitet den Vorgang vollständig vor: Zuordnung, Datenextraktion, Antwortentwurf, Folgeaufgabe. Der Mensch prüft und gibt frei. Aus Bearbeitung wird Kontrolle.

Stufe 3 – autonom im definierten Rahmen. Der Agent führt den Vorgang selbstständig aus, solange er sich innerhalb festgelegter Grenzen bewegt – etwa bestimmte Vorgangsarten, Sparten, Betragsgrenzen oder eine Mindestsicherheit bei der Zuordnung. Die Prüfung erfolgt nachgelagert und stichprobenartig.

Stufe 4 – autonom mit Eskalation. Der Agent entscheidet auch über Zweifelsfälle und legt nur dann vor, wenn er die eigene Unsicherheit als zu hoch einschätzt oder eine definierte Ausnahme erkennt. Der Mensch arbeitet ausschließlich an Eskalationen.

Vier Achsen statt einer

Ein einzelner Stufenwert greift zu kurz, sobald mehrere Agenten zusammenarbeiten. In der Praxis sind vier Fragen getrennt zu beantworten:

Auslösung – wer startet den Vorgang? Entweder ein Mensch beauftragt die Bearbeitung, oder das System startet sie selbst, etwa bei Eingang einer Lieferung. Beauftragte Bearbeitung ist die konservativere und derzeit verbreitetere Variante.

Orchestrierung – wer entscheidet über den Weg? Hier setzt das Supervisor-Muster an: Eine übergeordnete Instanz nimmt eine komplexe Aufgabe an, zerlegt sie in Teilschritte und beauftragt die passenden Fachagenten – ohne für jeden Zwischenschritt nachzufragen. Innerhalb einer beauftragten Aufgabe kann die Bearbeitung damit vollständig selbstständig ablaufen, obwohl die Auslösung menschlich war.

Schreibende Wirkung im System – wer darf den Bestand verändern? Anlegen, Ändern und Löschen sind der Punkt, an dem aus Vorbereitung Wirkung wird. Praktikabel ist hier keine Einzelfallfreigabe, sondern eine Berechtigung: Das bestehende Rechte- und Rollenkonzept entscheidet, für welche Benutzer KI-gestützte schreibende Aktionen überhaupt zulässig sind. Die Steuerung liegt damit in einem Konzept, das im Betrieb schon gelebt und geprüft wird, und sie ist je Benutzer differenzierbar, statt für das gesamte System zu gelten.

Dabei sind zwei Begrenzungen zu unterscheiden, die häufig vermischt werden. Die Rechte bestimmen, welche Aktionen ein Agent ausführen darf. Der Datenscope bestimmt, auf welchen Datenbestand er dabei überhaupt sehen und wirken kann. Ein Agent, der im Auftrag einer Person arbeitet, erbt beides: Er kann keine Aktion ausführen, für die diese Person nicht berechtigt ist, und er sieht keinen Datenbestand, der außerhalb ihres Scopes liegt.

Praktisch ist die zweite Begrenzung die wirksamere. Sie greift auch dann, wenn ein Agent fehlerhaft arbeitet oder eine Aufgabe missverständlich formuliert war: Über den Scope hinaus existiert für ihn nichts. In Strukturen mit angeschlossenen Vermittlern, getrennten Mandanten oder abgegrenzten Teambeständen ist das die Eigenschaft, die den Einsatz überhaupt vertretbar macht – Abgrenzung entsteht nicht durch die Formulierung des Auftrags, sondern durch die Architektur.

Wirkung nach außen – was verlässt das Haus? Nachrichtenversand und verbindliche Aussagen gegenüber Kunden oder Versicherern sind eine eigene Kategorie. Hier ist eine Bestätigung vor der Ausführung angebracht, und zwar unabhängig davon, welche Rechte der Benutzer im System hat. Der Grund ist die Unumkehrbarkeit: Eine fehlerhafte Bestandsänderung lässt sich korrigieren, eine versandte Nachricht nicht zurückholen.

Ein System kann also auf der Orchestrierungsachse weit fortgeschritten sein, schreibende Aktionen über Berechtigungen freigeben und beim Versand nach außen bewusst konservativ bleiben. Diese Kombination ist keine halbe Lösung, sondern die Bauform, die in regulierten Märkten trägt.

Agenten selbst bauen

Ein zweiter Punkt entscheidet über den praktischen Nutzen: ob Fachagenten ausschließlich vom Hersteller kommen oder ob ein Betrieb eigene definieren kann. Konfigurierbare Ablaufketten – ohne Programmierung, im System selbst erstellt und im Team geteilt – verlagern die Automatisierung dorthin, wo das Prozesswissen liegt. Für Vorgangsarten, die nur in einem einzelnen Betrieb in dieser Form auftreten, ist das der einzige realistische Weg zur Automatisierung.

Wo die Grenze bleibt

Die Stufen 3 und 4 sind für regelklare, wiederkehrende Vorgänge ohne unmittelbare Kundenwirkung gedacht: Posteingangsverarbeitung, Dokumentenzuordnung, Bestandspflege aus strukturierten Lieferungen, Datenanreicherung, Abstimmungsroutinen.

Für schreibende Vorgänge im Bestand entscheidet die Berechtigung des jeweiligen Benutzers, nicht die Vorgangsart allein. Für Kommunikation nach außen bleibt die Bestätigung unabhängig von Rechten und Erkennungsgüte bestehen. Diese Grenze ist keine technische Beschränkung, sondern eine bewusste Festlegung: Sie ist der Grund, warum höhere Autonomie an anderer Stelle vertretbar ist.

Verhältnis zur Aufsichtspflicht

Der EU AI Act verlangt geeignete menschliche Aufsicht. Aufsicht wird häufig mit Einzelfallfreigabe gleichgesetzt – das ist eine Verkürzung. Wer Grenzen vorab definiert, Ergebnisse nachgelagert prüft, Abweichungen auswertet und jederzeit eingreifen kann, übt Aufsicht aus. Ein dokumentiertes Stufenmodell macht diese Aufsicht überhaupt erst prüfbar, weil es festhält, welcher Vorgang mit welchem Grad an Selbstständigkeit bearbeitet wurde.

Einführung in der Praxis

Bewährt hat sich ein Vorgehen je Vorgangsart statt je System: eine Vorgangsart auswählen, die häufig auftritt und klar geregelt ist; auf Stufe 2 starten; Trefferquote, Korrekturen und Ausnahmen über einige Wochen messen; und erst bei stabilen Werten höherstufen. Die Messwerte sind der Beleg, mit dem eine Höherstufung fachlich – und gegenüber Aufsicht und Wirtschaftsprüfung – begründet wird.

Häufige Fragen

Warum ein Stufenmodell statt einer Entscheidung für oder gegen Autonomie?

Weil das Risiko nicht am System hängt, sondern am einzelnen Vorgang. Die Zuordnung eines Dokuments zu einem Vertrag und die Änderung einer Versicherungssumme sind unterschiedlich kritisch. Ein Stufenmodell erlaubt, den Grad der Selbstständigkeit je Vorgangsart festzulegen, statt ihn für die gesamte Software zu bestimmen.

Widerspricht autonome Verarbeitung der Anforderung menschlicher Aufsicht?

Nein. Der EU AI Act verlangt geeignete menschliche Aufsicht, nicht die Freigabe jedes Einzelfalls. Aufsicht kann auch bedeuten, Regeln und Grenzen vorab festzulegen, Ergebnisse nachgelagert zu prüfen und jederzeit eingreifen zu können.

Welche Vorgänge sollten immer freigabepflichtig bleiben?

Vorgänge mit unmittelbarer Kundenwirkung – etwa Vertragsänderungen, Kündigungen, verbindliche Aussagen zur Deckung oder Zahlungen. Hier bleibt die Freigabe durch eine verantwortliche Person im Vermittlerkontext gängige und empfehlenswerte Praxis.

Wie führt ein Betrieb höhere Autonomiestufen ein?

In der Regel schrittweise und je Vorgangsart: zunächst als Vorschlag mit Freigabe, dabei Trefferquote und Ausnahmen messen, und erst bei stabilen Ergebnissen auf eine höhere Stufe umstellen. Das erzeugt die Erfahrungswerte, die eine Höherstufung fachlich begründen.