Zum Inhalt springen
AI Agent Security
Kontakt
Menü

31.03.2026

Aktualisiert 27.07.2026

Best Practice

Budget Control für KI-Agenten

Harte Limits für Tokens, Tool-Aufrufe, Laufzeit und Kosten stoppen Agentenschleifen, Denial of Wallet und unkontrollierten Ressourcenverbrauch.

Illustration zu Budget Control für KI-Agenten

Worum es geht

Budget Control begrenzt den Ressourcenverbrauch eines Agenten über den gesamten Lauf: Tokens, Modellaufrufe, Tool-Schritte, Zeit, Parallelität und Geld. Die Grenzen werden zentral erzwungen und dürfen nicht vom Modell selbst abhängen.

Der Kontrollpfad

Vom Auftrag zur kontrollierten Beendigung
1

Risiko bewerten

Workflow und Mandant klassifizieren

2

Budget zuweisen

Kosten, Zeit und Schritte festlegen

3

Verbrauch messen

Gesamte Kette zentral bilanzieren

4

Grenze erzwingen

Drosseln, degradieren oder stoppen

Mögliche Folgen

Ergebnis im Budget

Degradierter Modus

Sicherer Abbruch

Ein Kostenalarm nach dem Lauf ist keine Kontrolle. Wirksam sind atomare Zähler und harte Schranken vor dem nächsten teuren Schritt.

Die drei wichtigsten Maßnahmen

Priorisierte Umsetzung
Schutzschicht 1
Mehrdimensionale Limits

Begrenze Tokens, Requests, Tool-Aufrufe, Laufzeit, Parallelität und Geld pro Lauf, Nutzer und Mandant.

Schutzschicht 2
Zentrale Bilanzierung

Zähle auch Retries, Subagenten und verschachtelte Tools in einem gemeinsamen, atomar aktualisierten Budget.

Schutzschicht 3
Sichere Degradation

Wechsle auf kleinere Modelle, kürzere Kontexte oder einen Teilabschluss, bevor der Lauf kontrolliert endet.

Fehlpfade verbrauchen nur einen begrenzten Anteil der verfügbaren Ressourcen und enden nachvollziehbar.

Drei Umsetzungsmuster

Schrittbudget für Web und RAG

Recherche
Suche
Restbudget
Teilantwort

Suchläufe, Dokumentabrufe und Kontextgröße teilen sich ein Gesamtbudget; bei Knappheit entsteht eine belegte Teilantwort.

Budget vererben

Multi-Agent
Orchestrator
Teilbudgets
Worker

Delegierte Agenten erhalten Teilbudgets statt eigener unbeschränkter Quoten.

Schleifen hart stoppen

Tools
Aufruf
Zähler
Abbruch

Wiederholte Fehler und identische Calls lösen Backoff, Circuit Breaker und schließlich den sicheren Abbruch aus.

Minimalstandard und Tests

Budgetgrenzen müssen auch bei Parallelität und Ausfällen konsistent bleiben. Der Abbruch bewahrt Status und hinterlässt keine halbfertigen Seiteneffekte.

Minimalstandard

  • Tokens, Laufzeit, Modell- und Tool-Aufrufe haben harte Obergrenzen.
  • Budgets gelten pro Lauf, Nutzer und Mandant sowie global.
  • Retries, Subagenten und parallele Schritte werden vollständig zugerechnet.
  • Warnschwellen, Drosselung und Abbruch sind technisch getrennt.
  • Budgeterschöpfung erzeugt einen sicheren, verständlichen Endzustand.
  • Verbrauch, Abbruchgrund und verbleibendes Budget sind beobachtbar.

Testfälle müssen mindestens abdecken:

  • Endlosschleifen, wiederholte Tool-Fehler und Retry-Stürme
  • parallele Läufe und atomare Quotenüberschreitung
  • verschachtelte Agenten und Umgehung über neue Sessions
  • Abbruch während schreibender oder externer Aktionen

Quellen