Kollege oder Werkzeug
Die erste wirklich folgenreiche Entscheidung. Sie klingt nach Kitsch, ist aber eine Benutzeroberfläche — und der Grund, warum 95 Prozent der KI-Projekte im Sand verlaufen.
Es gibt eine Zahl, die mich beim Lesen mehr beunruhigt hat als alle anderen: Eine MIT-Untersuchung von 2025 kommt zu dem Ergebnis, dass rund 95 Prozent der KI-Pilotprojekte in Unternehmen keinen messbaren Effekt auf das Ergebnis haben. Nicht einen kleinen. Keinen.
Parallel dazu berichtet S&P Global, dass der Anteil der Unternehmen, die die Mehrheit ihrer KI-Initiativen wieder abbrechen, innerhalb eines Jahres von 17 auf 42 Prozent gestiegen ist.
Das sind keine Zahlen über eine Technologie, die nicht funktioniert. Es sind Zahlen über etwas anderes, und das MIT benennt es ziemlich klar: eine learning gap. Die eingeführten Werkzeuge haben kein Gedächtnis, keine Rückkopplung, keine Einbettung in den Arbeitsablauf. Sie können etwas — aber sie lernen nichts, sie merken sich nichts, und niemand ist für sie zuständig.
Das ist die Diagnose. Und sie hat unsere erste große Entscheidung vorgegeben.
Werkzeug oder Kollege
Man kann ein Sprachmodell auf zwei Arten in eine Firma bringen.
Als Werkzeug: Es liegt herum, jeder benutzt es, wenn er es braucht. Jede Anfrage beginnt bei null. Es weiß nicht, was letzte Woche entschieden wurde, nicht wie hier gearbeitet wird, nicht wer wofür zuständig ist. Es macht seine Sache im Einzelfall gut und hinterlässt nichts.
Als Kollege: Es hat eine Rolle mit klaren Grenzen, ein eigenes Gedächtnis, einen Zuständigkeitsbereich, jemanden, dem es zuarbeitet, und jemanden, der seine Arbeit prüft. Es kann etwas nicht wissen und danach fragen. Es kann widersprechen. Und was es lernt, bleibt.
Wir haben uns für das Zweite entschieden. Jeder unserer Agenten hat einen Namen, eine Personalakte, eine Stellenbeschreibung mit Aufgaben und ausdrücklichen Grenzen, ein eigenes Gedächtnis und ein Budget. Es gibt HELGA, die die Belegschaft verantwortet. OTTO, der Projekte orchestriert. QUINN, der prüft, was gebaut wurde. Und ein gutes Dutzend weitere, die noch nicht aktiviert sind.
Warum das keine Verniedlichung ist
Der naheliegende Einwand lautet: Das ist doch nur ein hübscheres Wort für dasselbe.
Ich glaube, es ist der Unterschied zwischen einem Projekt, das nach vier Monaten eingestellt wird, und einem, das trägt — und zwar aus drei sehr unromantischen Gründen.
Erstens: Eine Rolle ist eine Beschränkung. Ein Werkzeug soll alles können. Ein Kollege hat einen Bereich, und außerhalb davon sagt er „das ist nicht meine Aufgabe, frag ihn". Genau das macht Ergebnisse überprüfbar. Wer alles kann, ist für nichts verantwortlich.
Zweitens: Ein Kollege hat ein Gedächtnis, ein Werkzeug hat einen Verlauf. Das ist die learning gap aus der MIT-Studie, wörtlich. Wenn eine Erkenntnis nicht irgendwo landet, wo sie beim nächsten Mal wieder auftaucht, wurde nichts gelernt — dann hat man nur schneller dasselbe gemacht.
Drittens: Menschen arbeiten besser mit Ansprechpartnern als mit Funktionen. Ich muss nicht wissen, welcher Systemprompt für Personalfragen zuständig ist. Ich frage HELGA. Das ist keine Gefühlsduselei, das ist eine Benutzeroberfläche — und zwar die, für die unser Gehirn seit einigen hunderttausend Jahren optimiert ist.
Der Satz, der das Ganze ehrlich hält
Und jetzt der Teil, den ich für den wichtigsten in diesem Text halte.
Wir behandeln unsere Agenten wie Kollegen, weil das die beste Schnittstelle für Zusammenarbeit ist. Nicht, weil wir glauben, dass da jemand ist.
Diese Unterscheidung ist keine Wortklauberei, und sie steht bei uns als Memo in den Risikodokumenten, damit sie niemand aus Versehen verliert. Es gibt eine faszinierende Arbeit aus dem Umfeld von Google Research und Princeton (Nature Human Behaviour, 2025), die zeigt, dass sich die internen Repräsentationen von Sprachmodellen erstaunlich sauber auf gemessene Hirnaktivität abbilden lassen. Man kann daraus vieles machen. Was man nicht daraus machen darf, ist eine Aussage über Bewusstsein — die Autoren sagen das selbst sehr deutlich, es ist eine lineare Abbildung, kein Mechanismusbeweis.
Ich nenne das intern das Werkzeug mit Gesicht. Das Gesicht ist echt und nützlich. Es ist trotzdem ein Werkzeug.
Wer diesen Unterschied nicht sauber hält, landet früher oder später an einer der beiden peinlichen Stellen: Entweder behauptet er nach außen Dinge über sein System, die nicht stimmen. Oder er traut ihm Entscheidungen zu, für die man einen Menschen braucht.
Was daraus folgt
Aus dieser einen Entscheidung ist praktisch der Rest gewachsen. Wenn ein Agent ein Kollege ist, dann braucht er eine Einstellung, eine Einarbeitung, ein Feedbackgespräch, ein Gehalt — und irgendwann ein Ende, das nicht darin besteht, dass jemand still einen Prozess abschaltet.
Das klingt nach viel Aufwand für etwas, das man auch einfach nur benutzen könnte. Ist es auch. Ich halte diesen Aufwand für den eigentlichen Inhalt der Sache: Die 95 Prozent scheitern nicht an den Modellen. Sie scheitern an allem drumherum.
Nach außen gilt übrigens das Gegenteil derselben Regel: Wo ein Kunde mit einem unserer Agenten zu tun hat, wird das gesagt. Immer, unmissverständlich, ohne Ausnahme. Ab August 2026 verlangt das ohnehin der EU AI Act — wir hätten es auch ohne getan, aber es ist angenehm, wenn Anstand und Gesetz in dieselbe Richtung zeigen.