Sicherheit & Risiko
Was passiert, wenn es schiefgeht – und merkt es jemand?
Worum es geht
Diese Rubrik betrachtet KI-eigene Risiken: erfundene Inhalte, Datenabfluss in fremde Modelle, unklare Verantwortung für maschinelle Ergebnisse. Gefragt ist, ob diese Risiken bewertet und behandelt werden – nicht, ob es keine gibt.
Wichtig ist: Sicherheit bei KI klingt nach Verhindern. Gemeint ist Bemerken. Ein Modell, das eine falsche Zahl nennt, ist ärgerlich. Ein Modell, das über eine manipulierte Eingabe fremde Anweisungen befolgt (= Prompt Injection), ist ein Vorfall. Wer von beidem erst aus einer Kundenbeschwerde erfährt, steht auf Stufe 1. Daran ändert gute Technik daneben nichts.
Die fünf Stufen
- Stufe 1 – Experimentieren Niemand prüft, welche Daten in welches Modell gehen. Ein Vorfall würde nicht auffallen.
- Stufe 2 – Pilot Erste Risikoliste existiert – Datenabfluss, Fehlausgaben, Anbieterabhängigkeit. Umgesetzt ist davon wenig.
- Stufe 3 – Kontrollierter Rollout Ein- und Ausgaben werden gefiltert, sensible Daten erkannt. KI-Vorfälle sind definiert und meldepflichtig.
- Stufe 4 – Skalierter Regelbetrieb Jeder Agentenlauf ist nachvollziehbar, die Modell- und Werkzeug-Lieferkette ist geprüft, der Incident-Prozess wurde geübt.
- Stufe 5 – Agentische Organisation Angriffe auf Agenten werden laufend simuliert und erkannt, Schutzmaßnahmen schärfen sich aus den Vorfällen nach.
Woran man es erkennt
Ab Stufe 3 zählt ein Beleg und keine Selbstauskunft, da im Assessment sonst jede Behauptung gleich viel wert wäre.
- Stufe 3 – Kontrollierter Rollout
- Filterregeln, Meldeweg für KI-Vorfälle, benannte Verantwortliche.
- Stufe 4 – Skalierter Regelbetrieb
- Lückenlose Protokolle, Lieferkettenprüfung, dokumentierte Übung.
- Stufe 5 – Agentische Organisation
- Red-Team-Berichte, Angriffserkennung, nachgeführte Schutzregeln.
Der nächste Schritt
Der Sprung auf die nächste Stufe fällt je Ausgangslage anders aus, deshalb steht hier für jede der vier Kombinationen eine eigene Zeile.
| Von | Nach | Nächster Schritt |
|---|---|---|
| Stufe 1 – Experimentieren | Stufe 2 – Pilot | Erst sehen, was läuft. Die genutzten KI-Dienste inventarisieren, eine Ampel für erlaubte Eingabedaten festlegen und die Risiken in einem Termin schriftlich benennen. |
| Stufe 2 – Pilot | Stufe 3 – Kontrollierter Rollout | Von der Liste zur Wirkung. Filter und Meldeweg technisch verankern, bevor Agenten auf interne Daten zugreifen. |
| Stufe 3 – Kontrollierter Rollout | Stufe 4 – Skalierter Regelbetrieb | Vom Schutz zur Nachvollziehbarkeit. Jeden Agentenlauf protokollieren, die Modell- und Werkzeug-Lieferkette prüfen und den Incident-Prozess einmal mit einem KI-Szenario üben. |
| Stufe 4 – Skalierter Regelbetrieb | Stufe 5 – Agentische Organisation | Vom Reagieren zum Angreifen. Eigene Angriffe auf die Agenten zum Regeltermin machen, Angriffserkennung auf den Agentenverkehr legen und Drift gegen Schwellenwerte überwachen. |
Häufige Fragen
- Wie wird bei Ihnen kontrolliert, welche Daten in welches KI-Modell gehen dürfen?
- Ganz unten, auf Stufe 1, lautet die Antwort: Gar nicht – das entscheidet jede und jeder beim Tippen selbst. Ganz oben, auf Stufe 5: Agenten führen die Freigabe je Datenklasse mit; unzulässige Kombinationen werden im Lauf gestoppt. Dazwischen liegt Stufe 3: Datenklassen sind festgelegt, und eine benannte Rolle gibt Modelle je Klasse frei.
- Würde es bei Ihnen auffallen, wenn ein KI-System heute Schaden anrichtet? Was passiert dann?
- Stufe 3 heißt hier konkret: Ein KI-Vorfall ist definiert, meldepflichtig und hat eine benannte Anlaufstelle. Wer noch auf Stufe 1 steht, antwortet stattdessen: Es würde vermutlich niemandem auffallen. Und auf Stufe 5 gilt: Auffälligkeiten im Agentenbetrieb werden laufend erkannt und schärfen die Schutzregeln nach.
- Wie gut ist Ihr KI-Einsatz gegen manipulierte Eingaben geschützt, und wie gut gegen ungewollten Datenabfluss?
- Prüfen Sie, welcher Satz auf Sie zutrifft, da die Beschreibung selbst die Stufe ist. Stufe 1: Gar nicht – was in den Chat geht, geht hinaus. Stufe 3: Eigene Filter für Ein- und Ausgaben greifen; sensible Daten werden erkannt und blockiert. Stufe 5: Wir greifen unsere eigenen Agenten regelmäßig an und verschärfen die Filter aus den Funden.
Wo steht diese Dimension bei Ihnen?
Zwei der sechzehn Fragen im Check betreffen genau diese Dimension. Rechnen Sie mit 10 bis 15 Minuten. Ihr Zackenprofil sehen Sie direkt danach, das ausführliche Ergebnis kommt per E-Mail.
Check starten