KI Agenten kontrollieren, bevor sie senden
Sep 23, 2026
"Claude in Chrome is not connected."
Die Meldung kam am Sonntag, 17. August, kurz nach neun Uhr morgens. Zwanzig Minuten später kam sie wieder. Dann ein drittes Mal. Als ich am Abend die Reports durchging, stand derselbe Satz sechsmal da, von sechs verschiedenen Agenten, die alle denselben Auftrag hatten: LinkedIn bespielen, mitten in der wichtigsten Kampagnenwoche des Jahres.
Keiner der sechs hatte etwas falsch gemacht. Jeder hatte exakt gemeldet, was tatsächlich passiert war. Trotzdem lag ein ganzer Kanal für Stunden still, während oben im Wochenplan in fetten Buchstaben stand, wie hoch das Tagesziel für neue Anmeldungen war. Ein KI Agent, der ehrlich meldet, dass er nicht arbeiten kann, sieht von aussen fast genauso aus wie einer, der schweigt. Das habe ich an diesem Sonntag hart gelernt.
Bevor du weiterliest: Diese 5 Fragen zeigen dir, ob dein Business ein System-Problem hat. Hol dir die 5 Fragen mit dem 17-Minuten-Video →
Was ist am 17. August passiert?
Sechs meiner LinkedIn-Agenten fielen am selben Tag aus, weil die Verbindung zu Chrome abbrach. Keiner davon hat das verschwiegen. Jeder hat es gemeldet. Das Problem war nicht die Technik. Das Problem war, dass zwischen der Meldung und meiner Kontrolle zu viele Stunden lagen.
Emil, Cora, Nina, Franz und Leo, dazu ein sechster Agent in der Folge, meldeten alle denselben Hard Stop. Laut Protokoll war es bereits der vierte identische Ausfall an diesem Tag, als ich ihn zum ersten Mal bewusst wahrnahm. Kein Verkaufsgespräch lief an diesem Tag über LinkedIn. Keine Verbindungsanfrage, keine Antwort, kein Kommentar. Und das ausgerechnet in der Woche, in der jede einzelne Berührung zählte.
Stell dir vor. Du hast sechs Mitarbeiter losgeschickt, jeder mit demselben klaren Auftrag. Um neun Uhr morgens meldet der Erste: "Ich komme nicht rein, die Tür ist zu." Zwanzig Minuten später der Zweite, dieselbe Tür. Dann der Dritte. Du hast die Meldung gesehen und dachtest, das regelt sich von allein. Erst am Abend hast du gezählt, wie oft dieselbe Tür zugefallen ist.
20 Agenten sind bei mir täglich im Einsatz. Sechs davon lahmgelegt, an einem einzigen Sonntag, mitten im Endspurt einer Kampagne. Das ist kein kleiner Fehler. Das ist ein Drittel meiner LinkedIn-Mannschaft, die schweigend an der Tür stand, während ich anderswo arbeitete und annahm, es liefe.
Ein Mitarbeiter, der ehrlich meldet "ich kann gerade nicht arbeiten", hat nichts falsch gemacht. Er hat sogar alles richtig gemacht. Das Problem entsteht erst, wenn niemand hinschaut, bis der Tag vorbei ist. Genau das ist mir an diesem Sonntag passiert, nicht weil ich es nicht besser wusste, sondern weil ich es an diesem einen Tag nicht kontrolliert habe.
Warum ist eine Review-Schleife wichtiger als noch mehr Agenten?
Eine Review-Schleife ist wichtiger als noch mehr Agenten, weil ein Agent, der schweigt oder scheitert, genauso aussieht wie einer, der arbeitet, solange niemand das Ergebnis prüft. Ohne Kontrolle ist Automatisierung nur ein schnellerer Weg, denselben Fehler öfter zu machen.
Bei uns im System gilt seit einiger Zeit eine feste Regel: Zwei identische Fehlläufe in Folge gelten automatisch als Alarm, nicht erst der dritte oder vierte. Wir nennen das intern die NULL-OUTPUT-Regel. Jeder Agent trägt in die erste Zeile seines Reports, ob er etwas geliefert hat oder nicht, damit niemand einen leeren Lauf für einen ruhigen Tag hält. Am 17. August stand diese Regel zwar auf dem Papier, aber am Sonntagabend hat sie niemand ausgewertet, bevor der Tag vorbei war. Eine Regel, die niemand liest, ist keine Regel. Sie ist eine Absichtserklärung.
Kennst du das? Ein System, das auf dem Papier perfekt aussieht, und trotzdem läuft am Sonntag nichts. Genau darum geht es bei Kommandieren, Kontrollieren, Korrigieren, dem Prinzip aus zwanzig Jahren Militär, das ich auf jeden meiner Agenten anwende. Wie diese drei Schritte konkret zusammenspielen, habe ich ausführlich beschrieben in KI Agent führen statt bauen. Kommandieren war an diesem Sonntag kein Problem, jeder Agent wusste genau, was seine Aufgabe war. Kontrollieren war die Lücke.
Und diese Lücke ist keine Ausnahme, die nur mir passiert. Jeder, der Wissen hat, aber kein System dahinter, kennt diesen Moment: Du hast die Aufgabe erledigt, ein Tool eingerichtet, eine Automation gestartet, und dann verlässt du dich darauf, dass sie läuft, weil sie am ersten Tag gelaufen ist. Das ist genau die Stelle, an der aus Hoffnung ein Loch wird.
Wie baust du deine eigene Review-Schleife?
Du baust deine eigene Review-Schleife, indem du für jede automatisierte Aufgabe drei Dinge festlegst: eine ehrliche Meldung ganz am Anfang, eine feste Alarmschwelle und einen festen Zeitpunkt, an dem jemand tatsächlich hinschaut. Ohne diese drei Teile bleibt jede Automatisierung ein Blindflug mit Autopilot.
Schritt 1: Die Meldung kommt zuerst, nicht zuletzt. Jeder Agent oder jeder Prozess, den du automatisierst, schreibt als Allererstes in seinen Report, ob er geliefert hat oder nicht. Nicht als Fussnote am Ende eines langen Textes, den ohnehin niemand ganz liest. Genau diese Architektur, Trigger, Bedingung und Speicher für jeden Lauf, zeige ich Schritt für Schritt in Loop Engineering.
Schritt 2: Zwei Fehlläufe in Folge sind ein Alarm, kein Zufall. Ein einzelner Ausfall kann Pech sein, eine abgelaufene Sitzung, eine kurze Störung. Der zweite identische Ausfall in Folge ist ein Muster. Wer erst beim vierten oder fünften Mal hinschaut, hat schon zu viel verloren, wie an diesem Sonntag.
Schritt 3: Jemand schaut mindestens einmal am Tag auf die roten Meldungen. Nicht erst am Wochenende, wenn ohnehin schon viel gelaufen ist. Bei uns übernimmt das inzwischen ein zweiter Agent als Auffangnetz, der genau dann nachschaut, wenn der erste schweigt. Ein Mitarbeiter, der ein Ziel bekommt, das nirgends kontrolliert wird, marschiert trotzdem los. Das ist kein Zeichen von schlechter Arbeit. Das ist ein Zeichen von schlechter Führung, und die Führung bin in diesem System immer ich.
Wenn du noch ganz am Anfang stehst und dich fragst, warum du überhaupt ein Denksystem brauchst, bevor du das erste Werkzeug anfasst, lies zuerst KI Agent erstellen. Tool oder Denksystem? Das ist der Schritt davor.
Keine Angst, falls dir das nach zu viel Kontrolle klingt. Wir bauen das zusammen, du kannst alles fragen, und es gibt hier keine blöden Fragen. Eine Review-Schleife ist keine zusätzliche Baustelle. Sie ist die eine Sache, die verhindert, dass aus einem stillen Sonntag eine stille Woche wird.
Und du? Welcher Agent oder welcher Prozess in deinem Business läuft gerade, ohne dass du in den letzten sieben Tagen hingeschaut hast, was er tatsächlich geliefert hat?
Nicht Hoffnung. System.
Häufig gestellte Fragen
Wie viel Review-Schleife lässt du bei deinen Agenten drin, bevor was rausgeht?
So viel, dass ein Fehllauf nie zweimal in Folge unentdeckt bleibt. Jeder Agent meldet Erfolg oder Misserfolg in der ersten Zeile seines Reports, und zwei identische Ausfälle gelten automatisch als Alarm. Am 17. August lag die Regel auf dem Papier vor, ausgewertet wurde sie erst am Abend, das war die eigentliche Lücke.
Wie erkenne ich, dass ein Agent nur so tut, als würde er arbeiten?
Du schaust nicht auf die Meldung "fertig", sondern auf das tatsächliche Ergebnis. Ein Agent, der meldet, er habe geschrieben, aber der Ordner ist leer, hat dich nicht angelogen. Er wusste es selbst nicht besser. Genau darum reicht Vertrauen allein nicht, es braucht die Kontrolle daneben.
Muss ich jeden Agenten jeden Tag kontrollieren?
Am Anfang ja, jedes Mal, wenn er läuft. Sobald ein Agent über Wochen zuverlässig liefert, reicht ein wöchentlicher Blick. Das Intervall wächst mit dem Vertrauen, nicht umgekehrt, und in Kampagnenwochen mit hohem Risiko gilt wieder die engste Stufe.
Was mache ich, wenn mehrere Agenten gleichzeitig ausfallen?
Genau dafür braucht es die feste Alarmschwelle aus Schritt 2. Fallen mehrere gleichzeitig mit derselben Fehlermeldung aus, ist das fast nie Zufall, sondern eine gemeinsame Ursache, in meinem Fall eine unterbrochene Verbindung. Dann prüfst du zuerst die gemeinsame Ursache, nicht jeden Agenten einzeln.
Brauche ich Technikwissen, um eine Review-Schleife zu bauen?
Nein. Du brauchst dieselbe Fähigkeit, die du brauchst, um einen Menschen zu führen: klar sagen, was du erwartest, prüfen, ob es stimmt, und korrigieren, wenn nicht. Die drei Schritte oben kannst du auf einem Blatt Papier planen, bevor du auch nur eine Zeile Automatisierung anfasst.
Dein nächster Schritt
Die Community ist kostenlos. Der Agent Builder kostet CHF 97 im Monat, dafür bekommst du die fertigen Agenten zum Herunterladen, inklusive der Review-Architektur, mit der ich meine eigenen 20 Agenten führe.
Alex
Jeden Freitag eine KI-Idee.
60 Sekunden. Direkt umsetzbar.
Kein Tutorial. Kein Tool-Dump. Nur das, was ich diese Woche selbst gemacht habe.