Positionspapier: Agenten-Design untergräbt die Aufsicht, auf die es baut
Ein Positionspapier auf arXiv, AI Agents Push Humans Out of the Loop (2608.23642), vertritt eine These, die sich leicht formulieren lässt und für alle, die Agentenprodukte bauen, unbequem ist. Es wurde am 24. August eingereicht und am 6. September überarbeitet; an diesem Wochenende bekam es erneut Aufmerksamkeit.
Das Papier setzt bei der üblichen Antwort auf die Risiken autonomer Agenten an: einen Menschen in der Schleife zu halten. Das sei keine einfache Lösung, argumentieren die Autoren, aus zwei Gründen. Heutige Ansätze im Agenten-Design erschwerten wirksame menschliche Aufsicht; und die kognitiven Fähigkeiten, die Aufsicht verlangt, würden durch längere Nutzung von KI-Systemen selbst geschwächt. Ihr Schluss: Heutige Entwicklungs- und Einsatzpraktiken unterstützen Aufsicht nicht nur nicht, sondern tragen zu ihrem Verfall bei.
Sie schlagen eine andere Gewichtung vor. Die konkreten Ziele und kognitiven Anforderungen der Menschen, die Aufsicht führen, sollten gleichrangig mit der Leistungsfähigkeit der Agenten stehen. Um das greifbar zu machen, greifen sie auf bestehende Arbeiten zu Automatisierung und Mensch-Computer-Interaktion zurück und skizzieren Gestaltungsmerkmale und organisatorische Abläufe, die zweierlei leisten sollen: Aufsichtspersonen beim kritischen Urteilen unterstützen und dem Verkümmern von Fähigkeiten entgegenwirken, das sich einstellt, wenn man sich lange auf Automatisierung verlässt.

Was das bedeutet
Das Argument ist aus Luftfahrt und Industrieautomatisierung bekannt und dort gut untersucht: Je zuverlässiger ein automatisiertes System ist, desto weniger Übung bekommen die Menschen, die es überwachen, und desto schlechter greifen sie ein, wenn es darauf ankommt. Die Übertragung auf KI-Agenten kommt zur rechten Zeit, weil "ein Mensch gibt die Aktion frei" immer öfter als Sicherheitsmechanismus für Agenten angeboten wird, die Code schreiben, Geld bewegen oder Nachrichten senden.
Die praktische Frage für Teams ist, ob ihr Freigabeschritt echt ist. Wer täglich Hunderte sauber formulierte Vorschläge sieht und fast keinen ablehnt, übt wenig Aufsicht aus, wie auch immer der Prozess beschrieben ist. Das Papier ist ein Positionspapier, keine empirische Studie, und seine Vorschläge sind Skizzen, keine erprobten Entwürfe; sein Wert liegt darin, das Versagensmuster klar zu benennen.