Du hast 5 Agenten laufen. Und trotzdem schreibst du selbst die E-Mails.

Der Affe und das Werkzeug

Du bist kein Affe. Du bist ein Manager, der sich wie einer fühlt. Weil du Werkzeuge bedienst, statt sie zu beherrschen. HAI ist die Struktur, die dir deine Zeit zurückgibt.

Die drei Phasen

Vom Chaos zur Beherrschung

Tag 01

Der große Angriff

Du startest voll motiviert. Drei Agenten gleichzeitig. Einer soll den Code refactoren, einer die Kundenmail schreiben, einer die Recherche machen. Um 18 Uhr hast du 17 Tabs offen. Der Code hat einen Bug. Die Mail enthält falsche Zahlen. Die Analyse widerspricht dem, was du gestern gelesen hast. Du schließt den Laptop. Nicht zufrieden. Erschöpft.

Tag 14

Die erste Grenze

Heute passiert es zum dritten Mal: Ein Agent meldet "Done", aber das Ergebnis ist unbrauchbar. Du merkst, dass du der Meldung nicht blind vertrauen kannst. Du definierst deine erste Verifikationsregel: "Done" bedeutet nichts, bevor du den Output nicht gesehen und ein Artefakt geprüft hast. Zum ersten Mal hast du das Gefühl, wieder am Steuer zu sitzen.

Tag 30

Das System

Du hast jetzt einen klaren Tagesablauf. Jeder Agent bekommt vor dem Start eine Aufgabe mit festem Scope. An drei definierten Gates pro Tag stoppt die Arbeit — und du entscheidest, ob weitergeht oder korrigiert wird. Du delegierst wieder. Aber diesmal mit Kontrolle. Um 18 Uhr schließt du den Laptop. Und öffnest ihn nicht wieder.

Dienstag, 14:30 Uhr

Der digitale Dschungel

Du hast fünf Agenten parallel laufen. Codex schreibt gerade eine Funktion, die auf den Daten des Recherche-Agents aufbauen soll. Der Recherche-Agent hat aber gestern andere Zahlen geliefert als heute. Ein dritter Agent hat in der Zwischenzeit eine E-Mail an den Kunden verfasst — mit den alten Zahlen. Du merkst es nicht sofort. Du merkst es um 16 Uhr, als der Kunde antwortet und fragt, warum die Zahlen nicht stimmen. Zwei Stunden verbringst du damit, Schaden zu begrenzen, statt voranzukommen.

"Information Overload ist nicht das Problem. Das Problem ist fehlende Struktur. Wer Agenten einsetzt, ohne Grenzen zu ziehen, baut keinen Vorteil auf. Er baut Tokenverschwendung, Scope Creep und falsche Entscheidungen."

Das ist nicht mehr Arbeitsteilung. Das ist ein Kontrollverlust, den du dir selbst baust. 11x setzt den Agenten in eine definierte Rolle — und lässt dich im Regen stehen. Kein Interface-Design, kein Harness, kein Feedback-Loop. Manus? Kein Intake, kein Setup, keine Guardrails. Devin behandelt den Agenten als Teammitglied, nicht als Werkzeug. Replit nennt es Vibe Coding: Du gibst den Vibe vor, die KI trägt die kognitive Last. Was übrig bleibt? Du. Mit dem Chaos. Das ist nicht 11x. Das ist nicht Devin. Das ist HAI.

Die Methode

4 Stunden, die deinen Workflow retten

Schritt 01

Sichtbar machen

Wir listen auf, was gerade läuft. Jeder Agent-Thread wird zu einer inspectierbaren Arbeitseinheit. Kein Blackbox-Hoffen mehr.

Schritt 02

Reibung finden

Wo bricht es wirklich? Wo glaubst du der Done-Meldung? Wo sind die Aufgaben zu schwammig? Wir markieren die drei größten Zeitfresser.

Schritt 03

Grenzen setzen

Was darf der Agent allein? Was braucht ein menschliches Gate? Klare Scope-Definition statt endloser Delegation.

Schritt 04

Verifizieren & Planen

Jeder Output braucht ein prüfbares Artefakt. Du bekommst ein Owner-Packet mit konkreten Änderungen, Gates und einem Next Action Packet.

Der Ablauf

So funktioniert kontrollierte Agenten-Arbeit

Intake WUNSCH REIN Agent BEGRENZT ARBEITEN Gate MENSCH STOPPT Verify ARTEFAKT PRÜFEN Next Action ENTSCHEIDUNG NICHT OK → KORRIGIEREN Intake WUNSCH REIN Agent BEGRENZT ARBEITEN Gate MENSCH STOPPT Verify ARTEFAKT PRÜFEN Next Action ENTSCHEIDUNG NICHT OK → KORRIGIEREN

Nicht autonom. Nicht magisch. Ein wiederholbarer Kreislauf mit einem Menschen an den entscheidenden Punkten.

Keine Theorie. Kein Marketing. Fakten.

786 Sessions. Ein Überlebender.

Agent Sessions 786 Sessions

2.573 Stunden Agent-Arbeit analysiert, strukturiert und kontrolliert. Nicht simuliert. Nicht theoretisch. Aus echter Arbeit.

Eval Accuracy 97,3%

Sidecar-NG Benchmarks. Intern. Hart. Keine schönen Zahlen für Pitchdecks. Zahlen, die halten.

Benchmarks 166 Runs

AgentArena Benchmarks unter kontrollierten Bedingungen. Weil mehr Output nicht automatisch mehr Fortschritt bedeutet.

Kontrollregeln 44 Gates

Tripwire Map Kontrollregeln. 44 Stop-Punkte, die verhindern, dass ein Agent ohne dich entscheidet. Größer ist nicht automatisch echter.

Kein Guru. Ein Überlebender.

Ich war genau da, wo du jetzt stehst.

Ich habe den Agenten-Dschungel selbst durchquert. Von der ersten unstrukturierten Session bis zu einem orchestrierten System mit Gates, Verifikation und klaren menschlichen Entscheidungspunkten. Ich kenne den Moment, in dem man der "Done"-Meldung glaubt und später merkt, dass alles falsch ist.

Ich begleite dich nicht als Guru von oben. Ich schaue mit echter Agentenpraxis auf deinen Workflow und baue mit dir eine klarere, begrenztere und überprüfbarere Arbeitsweise. Die Maschine ist nicht der Ursprung. Die Maschine ist nur das Objekt, das ein Mensch bedienen können muss.

Keine Bitte. Eine Aufforderung.

In 4 Stunden wissen wir, ob du wirklich kontrollierst — oder nur glaubst zu kontrollieren.

Kein Verkaufsgespräch. Ein Arbeitstermin. Wir nehmen deinen Ist-Zustand, finden die drei größten Reibungspunkte und packen dir ein Owner-Packet mit konkreten Änderungen, Human Gates und einer Verifikationsregel. Danach: 7 Tage Follow-up, ob es hält. Pilotpreis: 500 €.