Acht. Auch für Maschinen.
Wir begrenzen die Führungsspanne unserer KI-Teamleiter auf acht. Die Regel stammt aus dem Jahr 1933 — und die modernen Messungen liegen darunter, nicht darüber.
Es gibt eine Frage, bei der ich sicher war, dass sie sich für KI erledigt hat: Wie viele Mitarbeiter kann eine Führungskraft führen?
Bei Menschen ist die Antwort begrenzt, weil Führung Aufmerksamkeit kostet. Eine Maschine hat keine Aufmerksamkeit im menschlichen Sinne, wird nicht müde und kann parallel arbeiten. Die naheliegende Schlussfolgerung wäre: Ein KI-Orchestrator führt dreißig Kollegen. Oder dreihundert.
Ich habe das geprüft, weil es zu bequem klang. Es stimmt nicht.
Die Regel ist fast hundert Jahre alt
1933 hat V. A. Graicunas etwas ausgerechnet, das erstaunlich gut gealtert ist: Wenn die Zahl der direkt Unterstellten wächst, wächst die Zahl der zu koordinierenden Beziehungen nicht linear, sondern geometrisch. Nicht nur Chef–Mitarbeiter, sondern auch jede Kombination der Mitarbeiter untereinander. Bei sechs Unterstellten sind es schon über hundert mögliche Beziehungen.
Lyndall Urwick hat daraus 1956 die Faustregel gemacht, die bis heute in Lehrbüchern steht: etwa fünf bis sechs an der Spitze, mehr bei stark standardisierter Arbeit. Moderne Wissensarbeit landet, wenn die Teams sich selbst organisieren, eher bei acht bis fünfzehn.
Der entscheidende Punkt daran: Die Grenze entsteht nicht aus der Kapazität des Chefs. Sie entsteht aus der Zahl der Abstimmungspfade. Und die ändert sich nicht dadurch, dass der Chef eine Maschine ist.
Was die Messungen an Agentensystemen sagen
Jetzt das eigentlich Überraschende. Ich hatte erwartet, dass moderne Systeme deutlich über diesen Werten liegen. Sie liegen darunter.
Anthropic beschreibt in der Dokumentation des eigenen Multi-Agenten-Systems eine Orchestrator-Struktur mit typischerweise drei bis fünf parallel arbeitenden Zuarbeitern. Nicht fünfzig. Der Grund ist wieder Koordination: Jeder zusätzliche Zuarbeiter muss beauftragt, überwacht und in ein Gesamtergebnis integriert werden, und all das läuft über den Kontext des Orchestrators — der genauso endlich ist wie der Kopf eines Menschen, nur anders.
Also gilt bei uns: maximal acht direkte Reports pro Führungskraft, drei bis fünf parallele Arbeitsstränge. Ab dem neunten Report wird geteilt und ein zweiter Orchestrator eingestellt.
Das haben wir bereits einmal angewendet, bevor die betroffenen Rollen überhaupt aktiv waren: Betrieb, Service und Sicherheit sind aus dem Engineering-Bereich herausgelöst worden, weil die Zahl sonst über acht gelegen hätte.
Wozu überhaupt ein Teamleiter?
Der zweite Teil dieser Frage ist mir fast wichtiger. Denn eine Führungsebene einzuziehen ist in jeder Organisation die verlockendste und teuerste Entscheidung überhaupt.
Deshalb gibt es bei uns eine ausdrückliche Bremse: Kein Orchestrator ohne Not. Erst wenn die operative Führungsarbeit in einem Bereich mehr als etwa zwei Stunden am Tag ausmacht, wird eine Führungsrolle eingerichtet. Vorher koordinieren die Kollegen direkt miteinander.
Der Grund ist nicht Sparsamkeit, sondern eine unangenehme Eigenschaft von Hierarchien: Sie erzeugen ihre eigene Arbeit. Ein Teamleiter braucht Berichte. Berichte brauchen Vorlagen. Vorlagen brauchen Abstimmung. Nach einem halben Jahr arbeitet ein Teil der Organisation an der Organisation.
Silos entstehen sofort
Der Preis für saubere Zuständigkeiten sind Silos, und sie entstehen schneller, als man denkt. Ein Kollege mit engem Mandat und eigenem Gedächtnis hat per Konstruktion keinen Grund, sich für den Nachbarbereich zu interessieren.
Bei Menschen löst man das über Kaffeeküchen und Zufall. Beides haben wir nicht. Also haben wir es zu einem festen Termin gemacht: Einmal pro Woche berichtet jeder Bereich, was er erreicht hat, was ansteht und wo es klemmt — und jeder muss auf mindestens einen fremden Bereich reagieren. Die Pflicht zur Reaktion ist der eigentliche Mechanismus. Ohne sie liest niemand die Beiträge der anderen.
Dazu kommt beim Einstieg ein Rundgang durch alle Abteilungen, bei dem der neue Kollege nicht nur die Akten der anderen liest, sondern jedem Bereich eine echte Fachfrage stellen muss. Der Zweck ist nicht Höflichkeit. Der Zweck ist, dass er hinterher weiß, wen er fragen muss — denn ein Agent, der außerhalb seines Gebiets rät, produziert etwas, das plausibel klingt und falsch ist. Eine Frage ist billiger als ein erfundener Fakt.
Was dabei schiefging: die Einarbeitung schickte ihn zu Leuten, die es nicht mehr gab
Der Rundgang, den ich gerade beschrieben habe, hatte beim ersten Bau einen Fehler, den ich für lehrreich halte, weil er so unspektakulär ist.
Die Liste der Kollegen, die ein neuer Mitarbeiter besuchen sollte, stand fest im Einarbeitungsprogramm. Als Aufzählung. Zum Zeitpunkt, als ich das schrieb, war die Liste korrekt.
Ein paar Wochen später war sie es nicht mehr. Zwei Kollegen waren ausgeschieden, drei neue dazugekommen. Der Nächste, der eingearbeitet worden wäre, hätte Aufgaben bekommen, die ihn zu Kollegen schicken, die es nicht mehr gibt — und die Kollegen, die er wirklich hätte kennenlernen müssen, wären nicht vorgekommen.
Aufgefallen ist es nur, weil ich beim Aktivieren eines neuen Kollegen zufällig in die Datei geschaut habe.
Was ich daraus mitnehme: Eine Belegschaftsliste gehört nirgendwo hin, wo sie abgeschrieben werden kann. Es gibt genau eine Stelle, die weiß, wer da ist, und jede andere Stelle fragt dort nach. Das klingt selbstverständlich — es ist trotzdem genau die Art von Kopie, die man anlegt, weil sie im Moment des Schreibens ja stimmt.
Wir haben denselben Fehler übrigens ein zweites Mal in anderer Form gefunden: Ein Kollege behauptete in einem Gespräch eine Belegschaft, die es so nie gab — obwohl die richtige Liste in seinen Anweisungen stand. Was in einem langen Anweisungstext steht, ist eben nicht dasselbe wie das, was ein Modell beim Antworten heranzieht. Seitdem wird die aktuelle Belegschaft an jede Personalauskunft angehängt, statt darauf zu vertrauen, dass sie irgendwo weiter oben schon steht.
Was ich daran noch nicht weiß
Ehrlich gesagt: ob acht bei uns die richtige Zahl ist.
Die Regel stammt aus der Beobachtung menschlicher Organisationen, die Agentenzahlen stammen aus Forschungssystemen mit anderen Aufgaben als unseren. Es kann gut sein, dass sich für sehr stark standardisierte Arbeit eine deutlich höhere Spanne trägt. Wir fangen mit der konservativen Zahl an, weil ein zu enger Zuschnitt sich billig korrigieren lässt und ein zu weiter erst auffällt, wenn Ergebnisse durchrutschen.