Ein befreundeter Vibe Coder hatte wieder einmal in beeindruckender Zeit ein komplexes Problem für einen Kunden mit Hilfe von Coding mit KI gelöst. Am gleichen Abend noch hatte er für einen neuen Kunden eine auf den Fall zugeschnittene Leistungsvereinbarung mit Hilfe eines bekannten LLM aufgesetzt. Glücklicherweise ließ er den Vertrag am nächsten Tag von einer Anwältin prüfen, die ihn darauf hinwies, dass wenigstens zwei der benannten Paragrafen im BGB gar nicht existieren und die Kündigungsfrist sich selbst widerspricht.
Was war geschehen? Die KI hatte ihr Bestes gegeben und geliefert, und wo ihr das Wissen fehlte, hatte sie halluziniert und eloquent in einer Weise dazu erfunden, dass es einer Person ohne juristische Expertise oder zumindest Grundverständnis nicht auffallen konnte.
KI ist wie ein Hütehund. Schnell, eifrig, nie müde, und ohne Führung treibt er die Schafe am Stall vorbei auf die nächste Bundesstraße, weil Treiben für ihn Selbstzweck ist, nicht das Ankommen. Das ist sein Wesen. Ein Sprachmodell sucht immer eine Antwort. Die Forschung geht davon aus, dass sich das nicht abstellen lässt. Es lässt sich aber eindämmen.
Ebenso bei unserem Freund, der die KI beim Programmieren tausendmal zielführend eingesetzt hatte und ihr auf einem neuen Feld nicht ausreichend Anweisungen gegeben hatte, so dass sie eifrig lief, nur in die falsche Richtung.
Ein Schäfer schreit den Hund nicht an und schafft ihn auch nicht ab. Er tut drei Dinge.
Er gibt Richtung. Das ist der Prompt, und zwar nicht der Satz „Bau mir das Feature", sondern der Rahmen. Ein Ziel pro Auftrag, entweder Diagnose oder Fix oder Prüfung, nie alles auf einmal. Was der Hund nicht anfassen darf, steht dabei, sonst fasst er es an. Wo ein Ergebnis eine Zahl hat, steht die erwartete Zahl vorher im Auftrag. Bei uns gilt außerdem, dass der Hund bei einer Warnung anhält statt weiterzulaufen, und wenn wir „stopp" schreiben, steht er. Ein Hund, der ein klares Kommando bekommt, rennt in die richtige Richtung. Ein Hund, der keins bekommt, interpretiert.
Und er schickt einen zweiten Hund. Das ist der Validator, und er ist nie derselbe, der die Arbeit gemacht hat. Was der zweite Hund ist, spielt keine Rolle. Ein Test, der vor und nach dem Lauf prüft, ob die Zahl zur Erwartung passt. Ein Regelwerk, gegen das ein Ergebnis gehalten wird, etwa ein Prozessmodell, in dem Schritte und Zuständigkeiten schon festliegen. Ein zweites Modell, das nur eine Frage hat, ob die genannte Quelle existiert. Oder ein Mensch, der weiß, was er sieht. Gemeinsam ist ihnen eines. Sie prüfen gegen einen Maßstab, den der erste Hund nicht selbst gesetzt hat. Seine eigene Meldung „alles sauber" zählt nicht, die Ausgabe zählt. Der zweite Hund ist nicht klüger als der erste. Er schaut nur von woanders auf die Weide.
Der Schäfer zählt am Gatter die Schafe. Das ist das Gate, die Freigabe. Bevor eine Herde den Pferch verlässt, zählt der Schäfer selbst. Nicht der Hund entscheidet, wann die Arbeit fertig ist. Bei uns schreibt kein Script einen Commit, das tut ein Mensch, nachdem er das Ergebnis geprüft hat. Das nennt sich Human-in-the-Loop. Nichts geht auf den Server außer über das Deploy-Script, das vorher prüft und nachher zählt. Das ist langsam, und es ist auch der einzige Moment, in dem jemand nachsieht, ob die Schafe wirklich da sind.
Unser Freund hatte, ohne es zu wissen, so ein Gate. Es hieß Anwältin und prüfte. Was ihm fehlte, war es, die Richtung vorzugeben. Ein Schäfer hätte gesagt, das ist nicht deine Weide, und den Hund gar nicht erst losgeschickt.
Warum KI?
Weil KI in einer Stunde die Weide absucht, für die wir einen Tag brauchen. Sie recherchiert, sortiert Daten, schreibt Code nach Vorgabe, dokumentiert nach Muster, und das ganz ohne Murren. KI arbeitet nachts, fragt nicht nach Gehalt, und wenn wir ein Sprachmodell zurückpfeifen, ist es nicht beleidigt. Das ist der Teil, den wir bei Menschen selten erleben. Dass sie bereitwillig ihre Fehler oder Dummheiten einräumen, nicht einschnappen und motiviert weiterarbeiten. Das macht KI an dieser Stelle aus unserer Sicht zu einem entspannteren Teamplayer als manchen humanen Zeitgenossen. Der Hund gibt seine Fehler auch nicht zu, das stimmt. Aber er verteidigt sie auch nicht.
Was KI immer brauchen wird, ist Führung. Eine klare und eindeutige Governance ist hier eine Pflicht. Ohne diese geht es nicht, oder die KI knallt uns Halluzinationen um die Ohren, und wir werden sie nicht bemerken.
Um Führung zu geben, ist es unerlässlich, dass wir Führung geben können, dass wir unser Arbeitsfeld verstehen und beherrschen, dass wir frei nach Feynman komplexe Sachverhalte so herunterbrechen können, dass sie auch ein Kind versteht.
KI ist ohne Führung schwer zu kontrollieren und liefert unproduktiven Wildwuchs.
Was das für die Arbeit mit KI heißt, ist lebenslanges Lernen, eindeutige Kommunikation und definierte oder auch SMARTe Ziele und Qualitäten wie Selbstreflexion, Lessons Learned und deduktives Denken.
Der Hund ist nicht das Problem. Ein Hund ohne Schäfer ist es.