Das Reifegradmodell: acht Dimensionen, fünf Stufen
Acht Dimensionen, fünf Stufen, 40 Stufenanker. Jede Stufe verlangt ein benennbares Merkmal, damit Sie am Ende eine Einordnung bekommen und keine Schätzung.
KI verstärkt, was da ist. Wer in fünf Dimensionen auf Stufe 4 steht und in einer auf Stufe 1, bekommt kein Mittelmaß – er bekommt das Problem der Stufe 1 in fünffacher Geschwindigkeit.
Von Stufe 1 bis Stufe 5
Jede Zelle beschreibt einen beobachtbaren Zustand, keine abstrakte Zahl. Die Beschreibung, die auf Sie zutrifft, ist Ihre Stufe. Das gilt für die kleine Frage wie für die große: „Gibt es eine schriftliche Nutzungsregel?“ steht neben „Leiten sich Agentenrechte automatisch aus einer Policy ab?“.
| 1 Experimentieren | 2 Pilot | 3 Kontrollierter Rollout | 4 Skalierter Regelbetrieb | 5 Agentische Organisation | |
|---|---|---|---|---|---|
| Governance & Recht | Keine verbindliche Regel vorhanden. | Nutzungsrichtlinie ist verabschiedet und kommuniziert. | Nur freigegebene Modelle sind technisch erreichbar. | Jeder produktive Anwendungsfall ist eingestuft und auditierbar. | Regeln sind als Code hinterlegt, Nachweise entstehen automatisch. |
| Kosten & Steuerung | Kosten sind unbekannt. | Budget ist gesetzt, aber nicht gesteuert. | Kosten je Use Case sind sichtbar, Limits greifen technisch. | Kosten sind je Use Case und Nutzer verrechnet. | Kosten-Nutzen-Steuerung läuft automatisch zur Laufzeit. |
| Infrastruktur & Rechte | Nutzung nur über SaaS-Oberflächen, keine Integration. | Erste Anbindung, Key-Modell ungeklärt. | Zentrale Plattform mit SSO und serverseitiger Authentifizierung. | Der Agent handelt im Auftrag des Nutzers und erbt dessen Rechte. | Agent-to-Agent mit durchgängiger Rechtekette. |
| Sicherheit & Risiko | Kein Risikoblick. Eingaben landen ungeprüft bei Dritten. | Risiken sind benannt, Maßnahmen fehlen. | Schutz gegen Prompt-Injection und Datenabfluss greift technisch. | Agentenläufe protokolliert, Incident-Prozess erprobt. | Red Teaming und Angriffserkennung laufen im Betrieb. |
| Wissen & Daten | Kontext kommt per Copy-Paste. | RAG auf einer einzelnen Quelle. | Mehrere Quellen über Konnektoren, rechtekonform. | Unternehmensweiter Knowledge Hub, Qualität wird gemessen. | Wissen steht als Dienst für Menschen und Agenten bereit. |
| Organisation & Befähigung | Nur einzelne Enthusiasten, niemand ist zuständig. | Freiwillige Sessions, Verantwortung ungeklärt. | Lernpfade je Rolle, Ownership je Use Case benannt. | Verbindliches Curriculum, Betriebsmodell steht. | Lernen und Ownership tragen sich im Arbeitsfluss selbst. |
| Kultur & Change | Stimmung unbekannt, Sorgen kursieren ungesteuert. | Sorgen sind bekannt, Begleitung ist punktuell. | Change-Begleitung je Rollout, Führung nutzt KI sichtbar. | Stehendes Change-Programm, Adoption wird gemessen und gesteuert. | Veränderung trägt sich selbst, Belegschaft fordert KI ein. |
| Anwendungsfälle & Wertbeitrag | Einzelexperimente, Nutzen wird behauptet. | Use-Case-Liste ohne Wertkriterium. | Priorisierung nach Wert und Machbarkeit, Zielgrößen je Fall. | Nutzen je Use Case gemessen, Portfolio wird gesteuert. | Fälle entstehen aus Prozessdaten, Nutzen wird laufend nachgeführt. |
Die Zielstufe folgt aus Ihrer Branche, Ihrer Regulierung und Ihrem Risikoappetit. Für ein Haus mit 200 Beschäftigten kann Stufe 3 die richtige Endstufe sein. Stufe 5 ist eine Option, keine Pflicht. Wir messen den Abstand zu der Stufe, die Sie erreichen wollen, nicht den Abstand zur fünften.
Zwei Werte je Frage
Je Item werden IST und SOLL erhoben. SOLL darf nicht kleiner als IST sein (Eingabe wird abgewiesen).
Im Assessment steht beides auf derselben Skala: das Ist als ausgefüllter Marker, das Ziel als gestrichelte Kontur. Die Lücke dazwischen zeigt die Reihenfolge Ihrer Arbeit, übersetzt nach IPA-Quadranten (= Importance-Performance-Analyse, eine Priorisierung nach Wichtigkeit gegen Erfüllungsgrad) in die Road.MAP.
Worauf das Modell aufbaut
Keine der acht Dimensionen ist frei erfunden. Jede stützt sich auf ein benanntes Rahmenwerk, das hier offenliegt, damit Sie nachvollziehen können, woher der Schnitt kommt.
| Rolle im Modell | Framework | Quelle | Anwendung |
|---|---|---|---|
| Dimensionsstruktur | Technology–Organization–Environment (TOE) | Tornatzky & Fleischer (1990), The Processes of Technological Innovation | Die acht Dimensionen sind entlang der TOE-Achsen geschnitten: Technologie (Infrastruktur & Rechte, Wissen & Daten), Organisation (Organisation & Befähigung, Kultur & Change, Kosten & Steuerung, Anwendungsfälle & Wertbeitrag), Umwelt (Governance & Recht, Sicherheit & Risiko). Damit ist die Vollständigkeit der Dimensionsmenge begründet und nicht bloß behauptet. |
| Stufenlogik | Staged maturity representation (CMMI / ISO/IEC 15504 SPICE) | CMMI Institute (2018), CMMI V2.0; ISO/IEC 15504 / ISO/IEC 33020 process-capability levels | Fünf ordinale Stufen mit kumulativer Semantik: eine Stufe gilt erst, wenn ihre Merkmale erfüllt sind – höhere Stufen setzen die niedrigeren voraus. Die Stufenbenennungen folgen der klassischen Progression (ad hoc → definiert → gesteuert → gemessen → optimierend), sind aber auf die agentische Zielstufe erweitert. |
| Antwortskalen der Kernfragen | Behaviourally Anchored Rating Scales (BARS) | Smith & Kendall (1963), Journal of Applied Psychology 47(2); Bernardin & Smith (1981) | Jede Kernfrage hat fünf ausformulierte, beobachtbare Zustandsbeschreibungen statt abstrakter Zahlen. Die gewählte Option IST die Stufe. BARS reduzieren nachweislich Beurteilerfehler (Milde-, Tendenz-zur-Mitte-, Halo-Effekt) gegenüber rein numerischen Skalen – genau die Fehler, die Selbsteinschätzungen von Reifegraden systematisch verzerren. |
| Konstrukte für Akzeptanz und Kultur | UTAUT / UTAUT2 and TAM | Venkatesh, Morris, Davis & Davis (2003), MIS Quarterly 27(3); Venkatesh, Thong & Xu (2012); Davis (1989) | Die Likert-Batterien der Dimensionen Kultur & Change sowie Organisation & Befähigung operationalisieren die UTAUT-Kernkonstrukte: Leistungserwartung, Aufwandserwartung, sozialer Einfluss, erleichternde Bedingungen – ergänzt um Vertrauen als eigenes Konstrukt. Damit sind Akzeptanzaussagen anschlussfähig an ein Jahrzehnt empirischer Adoptionsforschung. |
| Konstrukt psychologische Sicherheit | Team Psychological Safety | Edmondson (1999), Administrative Science Quarterly 44(2) | Die Items zu Fehlerkultur und psychologischer Sicherheit sind an Edmondsons validierter Sieben-Item-Skala orientiert und auf den KI-Kontext übertragen (Sorge vor Entwertung der eigenen Arbeit statt allgemeiner Teamsicherheit). |
| Struktur der Maßnahmen-Bausteine | ADKAR and Kotter's 8-step model | Hiatt (2006), ADKAR; Kotter (1996), Leading Change | Die ToDo-Bausteine der Dimension Kultur & Change sind nach der ADKAR-Sequenz geordnet (Awareness → Desire → Knowledge → Ability → Reinforcement): Sprung 1→2 adressiert Awareness und Desire, 2→3 Knowledge und Ability, 3→4 und 4→5 Reinforcement. Kotters Erfolgsformel liefert das Diagnosewerkzeug für fehlende Elemente. |
| IST/SOLL-Auswertung | Importance-Performance Analysis (IPA) | Martilla & James (1977), Journal of Marketing 41(1) | Der IST/SOLL-Doppelwert je Frage wird als IPA-Quadrantenanalyse ausgewertet: hohe Zielstufe bei niedrigem Ist = „concentrate here“ (Handlungspriorität), hohe Zielstufe bei hohem Ist = „keep up the good work“, niedrige Zielstufe bei niedrigem Ist = „low priority“, niedrige Zielstufe bei hohem Ist = „possible overkill“ (Überinvestition). Damit ist die Priorisierung der Road.MAP methodisch begründet und nicht Beratermeinung. |
| Anti-Verzerrungs-Mechanik | Evidence-gated maturity rating | Derived from published evidence-gated maturity rubrics (2024) | Stufen ab 3 gelten nur als belegt, wenn ein benennbares Artefakt existiert (Richtlinie, Dashboard, Protokoll, Rollenbeschreibung). Ohne Nachweis wird die Bewertung auf Stufe 2 gedeckelt und als „behauptet, nicht belegt“ markiert. Das Prinzip dahinter: Gespräche sind kein Nachweis. |
| Inhaltliche Referenz für Governance, Sicherheit, Regulatorik | EU AI Act, ISO/IEC 42001, NIST AI RMF 1.0, ISO/IEC 27001 und GDPR | Regulation (EU) 2024/1689; ISO/IEC 42001:2023 AI management systems; NIST AI 100-1 (2023) | Die Inhalte der Dimensionen Governance & Recht sowie Sicherheit & Risiko sind gegen diese Normen geschnitten: Risikoklassifizierung und Dokumentationspflichten nach EU AI Act, Managementsystem-Anforderungen nach ISO 42001, die Funktionen Govern/Map/Measure/Manage nach NIST AI RMF. So sind die Stufen 3 bis 5 auditanschlussfähig. |
| Mehrpersonen-Erhebung | Inter-rater divergence as a diagnostic signal | Practice-derived; methodologically related to inter-rater reliability (Cohen 1960; Shrout & Fleiss 1979) | Die Streuung zwischen Respondenten ist ein Ergebnis, kein Rauschen. Differenz ≥ 2 Stufen auf derselben Frage wird als Perception Gap ausgewiesen; Differenz ≥ 3 als Risiko. Aggregiert wird erst nach der Gap-Analyse, nie vorher. |
Wo steht Ihr Unternehmen?
Sechzehn Fragen, 10 bis 15 Minuten. Ihr Zackenprofil sehen Sie direkt danach, das ausführliche Ergebnis kommt per E-Mail.
Check starten