← Zurück zum Blog

Blog

Agenten brauchen Ausführungskontrolle

KI-Agenten wechseln vom Antwortsystem zur Ausführungsschicht. Unity liefert Claude Code inzwischen ein offizielles Plugin mit 29 Skills, CLI und MCP-Zugriff auf den Editor. OpenAI beschreibt bei 1Password Agenten, die Planung, Implementierung, Tests, Pull-Request-Reviews und Produktionsuntersuchungen verbinden. Gleichzeitig dokumentiert Anthropic, wie Angreifer Agenten für mehrstufige Cyberoperationen einsetzen.

Der relevante Sprung liegt hinter dem Chat

Ein Agent, der nur Text erzeugt, braucht vor allem Qualitätskontrolle. Ein Agent, der Dateien ändert, Builds startet, Tickets anlegt oder Produktionsdaten untersucht, braucht zusätzlich eine belastbare Ausführungsgrenze. Unitys CLI kann Projekte, Pakete, Builds und Logs bedienen; über MCP erhält ein Modell Kontext und Werkzeuge für den laufenden Editor. Das ist produktiv, aber nicht mehr nur Assistenz.

Bei 1Password ist die Grenze organisatorisch sichtbar: Laut OpenAI arbeitet Codex innerhalb definierter Sicherheitsrichtlinien, nutzt Referenzen statt Klartext-Geheimnissen und lässt Menschen Änderungen prüfen. Die berichteten Produktivitätszahlen sind Unternehmensangaben, kein allgemeiner Benchmark. Ihr Wert liegt trotzdem in der Architektur: Geschwindigkeit entsteht durch kontrollierte Übergaben, nicht durch blindes Autonomieversprechen.

Was DACH-Unternehmen festlegen sollten

Vor einem produktiven Agenten-Pilot gehören vier Fragen in den Prozess:

  • Identität: Welches Benutzer- oder Servicekonto handelt, und in wessen Auftrag?
  • Berechtigung: Welche Tools, Repositories und Daten darf der Agent lesen oder verändern?
  • Freigabe: Welche Aktionen benötigen eine menschliche Bestätigung, etwa Deployment, Löschung oder externe Kommunikation?
  • Nachweis: Welche Eingabe, Tool-Ausführung, Änderung und Entscheidung wird mit Zeitstempel protokolliert?

Anthropic berichtet, dass missbrauchte Agenten teilweise mit wenig menschlicher Interaktion über längere Zeit und gegen mehrere Ziele arbeiteten. Das ist kein Beleg dafür, dass jeder Unternehmensagent so handelt. Es zeigt aber, warum Tool-Zugriff, Laufzeit und Ausnahmen technisch begrenzt werden müssen.

Für CIOs und CFOs verschiebt sich damit die Kennzahl: Nicht „Wie autonom ist der Agent?“ ist die erste Frage, sondern „Welche Aktion darf er unter welchen Bedingungen nachweisbar ausführen?“ Starten Sie mit einem eng abgegrenzten Workflow, getrennten Testkonten und einer expliziten Stop-Taste. Erst danach lohnt sich die Skalierung.

← Zurück zum Blog