Was das in der Praxis bedeutet
Wenn ein Agent eigenständig Code schreibt, lautet die Frage nicht “Schreibt er gut?”, sondern “Woran merken wir, dass er schlecht geschrieben hat, bevor jemand Schaden nimmt?”. Das Harness beantwortet genau diese Frage automatisch.
Dazu gehören:
- Automatisierte Tests, die bestanden sein müssen, bevor etwas weitergeht.
- Code Review, bei dem ein Mensch oder ein anderer Agent das Ergebnis prüft.
- CI/CD als Tor, das nichts ungeprüft passiert.
- Monitoring und Observability, damit Sie sehen, was das System tatsächlich tut.
- Sicherheitsprüfungen und klare Grenzen dafür, wohin der Agent darf und wohin nicht.
- Menschliche Verantwortung: konkret, wer ein bestimmtes Ergebnis abgezeichnet hat.
Warum Unternehmen es unterschätzen
Die erste Einführung funktioniert meistens. Der Agent tut, was er soll, das Team ist begeistert, und um Leitplanken kümmert sich niemand, weil es ja läuft. Das Problem kommt später, wenn sich Modell, Daten oder Aufgabenstellung ändern und niemand merkt, dass die Ergebnisse still und leise schlechter geworden sind.
Eine einfache Regel gilt: Je mehr Zugänge, Werkzeuge und Kontext ein Agent hat, desto nützlicher ist er — und desto wichtiger werden die Leitplanken.
Wo die Grenze verläuft
Nicht alles braucht ein vollständiges Harness. Ein persönliches Werkzeug, das eine Person auf ihren eigenen Daten laufen lässt, ist mit Vibe Coding gut bedient. Sobald die Lösung Kunden, sensible Daten oder Geld berührt, sind Leitplanken Pflicht. Im Workshop Agentic Engineering ziehen wir diese Grenze an Ihren eigenen Projekten.