hybridresourcing Für die Warteliste anmelden

Kennisbank

Jenseits des Chatfensters: was die Testsitzung nicht misst

Ein Chatfenster ist eine Fußmatte, kein Haus

Wer zum ersten Mal mit einem Sprachmodell arbeitet, sieht etwas funktionieren. Es kommt eine Antwort, die Antwort stimmt oft genug, und die Schlussfolgerung liegt nahe: Das kann mehr. Diese Schlussfolgerung ist nicht falsch, aber sie beruht auf einem einzigen Moment in einem einzigen Fenster. Ein Chatfenster zeigt, ob ein Modell eine Frage beantworten kann. Es zeigt nicht, ob die Organisation dahinter die Frage richtig stellen kann, die richtigen Daten liefern kann und die Antwort in eine Entscheidung münden lassen kann, die tatsächlich Gewicht hat.

Dieser Unterschied ist der Grund, warum Pilotprojekte oft starten und selten skalieren. Der Pilot beweist, dass die Technologie etwas kann. Er beweist nichts über die sieben Dimensionen, die bestimmen, ob die Organisation dieses Können auch tragen kann: von Organisation und Führung über IT-Infrastruktur, Datenmanagement, Prozesse, Menschen, Governance bis hin zu Kultur. Ein Chatfenster testet einen Anwendungsfall, zu einem Zeitpunkt, mit einem Nutzer. Es sagt nichts darüber aus, was passiert, wenn hundert Nutzer dieselbe Frage stellen, mit Daten, die nicht immer sauber sind, in einem Prozess, der nicht auf eine Antwort ausgelegt ist, die schwankt.

Was die Reifegradmessung wohl tut

Die Reifegradmessung von hybridresourcing betrachtet nicht eine Aufgabe oder eine Antwort, sondern die Ebene darunter: die Frage, ob die Organisation als Ganzes bereit ist, mit KI zu arbeiten, und nicht nur damit zu experimentieren. Das geschieht über fünf Stufen — baseline, foundation, activation, insight, intelligence — und über sieben Dimensionen, die zusammen bestimmen, wo eine Organisation steht. Nicht jede Dimension wiegt zu jedem Zeitpunkt gleich schwer. Die fundamentalen Dimensionen, wie Organisation und IT-Infrastruktur, gehen den Dimensionen voraus, die davon abhängig sind. Das ist keine Entscheidung unsererseits, sondern die Reihenfolge, in der es funktioniert: Ohne eine funktionierende Infrastruktur hat gutes Datenmanagement wenig Halt, und ohne klare Entscheidungsfindung hat eine gute Infrastruktur wenig Wirkung.

Ein wichtiger Bestandteil der Messung ist die Plot-Runde. Mehrere Personen innerhalb der Organisation bewerten getrennt, ohne die Antworten der anderen zu sehen. Was daraus hervorgeht, ist nicht nur eine Position auf fünf Stufen, sondern auch die Streuung zwischen dem, was verschiedene Personen für wahr halten. Eine Geschäftsleitung, die glaubt, die Organisation befinde sich auf der Stufe activation, während die IT sich selbst auf baseline einordnet, hat ein Problem, das größer ist als der Durchschnitt. Diese Streuung ist oft aufschlussreicher als der Wert selbst: Sie zeigt, worüber sich die Organisation über sich selbst uneinig ist, und genau dort bleibt ein Pilotprojekt stecken, ohne dass jemand benennen kann, warum.

Was diese Methode nicht kann

Die Reifegradmessung gibt keine Antwort auf die Frage, welche Aufgaben KI übernehmen kann. Sie sagt nichts darüber aus, wie viel Zeit eine Funktion für eine bestimmte Tätigkeit aufwendet, und nichts darüber, was passiert, wenn diese Tätigkeit wegfällt. Sie misst Bereitschaft, nicht Übernahme. Eine Organisation kann in allen sieben Dimensionen hoch punkten und trotzdem keine einzige Aufgabe identifiziert haben, die zur Übertragung bereitsteht. Umgekehrt kann eine Organisation voller Aufgaben stecken, die sich hervorragend für Automatisierung eignen, während die Organisation selbst noch nicht so aufgestellt ist, dass dies verantwortungsvoll geschehen kann.

Die Messung gibt auch keine Auskunft darüber, welche Entscheidungen automatisiert werden dürfen oder nicht — das ist eine Frage, die eigene Aufmerksamkeit verdient, unter anderem in der Übersicht über Entscheidungen, die außerhalb der Reichweite von Automatisierung bleiben sollten. Und der Wert sagt nichts darüber aus, was in der Praxis an Dokumentation fehlt: Wer wissen möchte, was in ein Entscheidungsinventar gehört, findet das nicht in einer Stufe oder einer Dimension, sondern in einem separaten Prozess.

Was die Messung wohl leistet, ist Klarheit über die Ausgangsposition. Ein niedriger Wert in einer der sieben Dimensionen bedeutet nicht automatisch, dass grundlegend etwas falsch läuft; es bedeutet, dass zwei Wege möglich sind, und welcher der beiden zutrifft, unterscheidet sich je Organisation — ein Unterschied, der weiter ausgearbeitet wird auf der Seite, die die zwei Szenarien bei einem niedrigen Wert beschreibt. Wer mit einer eigenen Einschätzung beginnen möchte, kann dies auf den Seiten tun, die auf die Reife der Organisation selbst und auf die Reife der IT-Infrastruktur eingehen, als zwei der sieben Dimensionen, auf denen die vollständige Messung aufgebaut ist.

Warum diese Grenze besteht

Diese Trennung ist bewusst. Eine Organisation, die zuerst wissen will, ob KI ihr etwas einbringt, stellt eine andere Frage als eine Organisation, die wissen will, ob sie vorbereitet ist, KI verantwortungsvoll einzusetzen. Beide Fragen sind legitim, aber sie erfordern unterschiedliche Instrumente. Wer beide Fragen durcheinanderlaufen lässt, erhält eine Antwort, die auf keine der beiden Fragen richtig passt: einen Wert, der klingt wie eine Aufgabenanalyse, oder eine Aufgabenanalyse, die so tut, als sage sie etwas über organisatorische Bereitschaft aus.

Das Tool befindet sich im Aufbau

Die Reifegradmessung mit den fünf Stufen, den sieben Dimensionen und der Plot-Runde wird derzeit aufgebaut. Es gibt noch keine Umgebung, in der Sie sich heute einloggen und bewerten lassen können. Wer daran Interesse hat, kann sich für die Warteliste anmelden und wird informiert, sobald die Messung verfügbar ist.

Die Frage, die danach kommt

Sobald die Bereitschaft der Organisation einmal erfasst ist, bleibt die andere Frage unbeantwortet: welcher Teil der Arbeit selbst sich tatsächlich übernehmen lässt. Das ist nicht etwas, worauf diese Messung eingeht, und das ist auch nicht ihre Absicht. Diese Frage beantwortet der Werkscan von FTE TO AI, der pro Aufgabe berechnet, welcher Teil der Arbeit dafür infrage kommt, von KI übernommen zu werden — eine Berechnung, die erst dann etwas bedeutet, wenn die Organisation, in der sie landet, auch tatsächlich bereit ist, sie zu tragen.

Robbyde assistent van de volwassenheidsmeting

Vraag maar wat er moet staan voordat AI in uw organisatie kan landen.

Answers come from this site’s knowledge base. Not tailored advice, and not a scan of your company.