Blog
KI-Agenten brauchen ein Kapazitätsbudget
KI-Agenten werden schnell zu einer Kapazitätsfrage – nicht nur zu einer Lizenzentscheidung. OpenAI berichtet am 6. September aus dem eigenen Forschungsbetrieb, dass Forschende Mitte August insgesamt 3,1 Agenten-Arbeitstage je menschlichem Arbeitstag nutzten. Google Cloud fasst zugleich neue flexible Abrechnungs- und Kostenkontrollen für Agenten-Workloads zusammen.
Mehr Ausführung, mehr Steuerungsbedarf
Die OpenAI-Zahlen sind kein allgemeiner Benchmark für andere Unternehmen. Sie machen aber einen Effekt sichtbar, den IT- und Finance-Teams einplanen sollten: Wenn Teams mehrere Agenten parallel einsetzen, steigen Code, Experimente und Durchsatz. Gleichzeitig wachsen Inferenzverbrauch, Tool-Aufrufe, Sandbox-Laufzeiten und mögliche Folgekosten.
OpenAI nennt für den Median seiner Forschenden mehr als 600 US-Dollar API-Verbrauch pro Tag; das 90. Perzentil lag über 7.000 US-Dollar. Diese Werte lassen sich nicht auf einen Mittelständler übertragen. Die Richtung ist dennoch relevant: Eine fixe Pro-Nutzer-Lizenz bildet den wirtschaftlichen und operativen Verbrauch eines autonom arbeitenden Systems nur unvollständig ab.
Vom Lizenzbudget zum Arbeitsbudget
Google positioniert seine aktuellen Funktionen ausdrücklich als FinOps für KI: flexible Abrechnung und Kostenkontrollen für Agenten sollen Ausgaben steuerbar machen. Daraus folgt ein praktisches Steuerungsmodell. Vergeben Sie nicht nur Zugang zu einem Agenten, sondern ein begrenztes Arbeitsbudget pro Use Case.
Dieses Budget sollte vier Größen verbinden:
- Zweck: Welches überprüfbare Ergebnis darf der Agent erzeugen?
- Kapazität: Wie viele parallele Läufe, Tool-Aufrufe und Laufzeit sind zulässig?
- Kosten: Welches Monats- und Eskalationslimit gilt inklusive nachgelagerter Cloud-Dienste?
- Freigabe: Wer darf Budget, Modelle oder Berechtigungen erhöhen?
Konsequenz für DACH-Unternehmen
Starten Sie nicht mit einer generellen „Agenten-Flatrate“. Wählen Sie einen klaren Prozess, etwa Testfall-Erstellung oder Dokumentenklassifikation, und messen Sie Durchsatz, Qualitätskorrekturen, menschliche Prüfzeit und Vollkosten gemeinsam. Ein Kostenlimit ohne Qualitätskennzahl erzeugt bloß Sparzwang; ein Produktivitätsziel ohne Limit verschleiert Verbrauch.
Der Steuerungsgegenstand ist daher nicht der Chat, sondern die ausgeführte Arbeit. Wer Kapazität, Ausgaben und Entscheidungsrechte je Agenten-Workflow sichtbar macht, kann skalieren, ohne dass die Rechnung schneller wächst als der nachweisbare Nutzen.