Best Practice
Adversarial Training für KI-Agenten
Aktualisiert 27.07.2026 · Model Robustness
Realistische Angriffsdaten, getrennte Evals und sichere Zielreaktionen härten Modelle gegen Prompt Injection, Jailbreaks und manipulierte Agentenkontexte.
Schutzmaßnahmen
Die wichtigsten Kontrollen für sichere KI-Agenten – vom ersten Input bis zur laufenden Überwachung.
Landscape
Die Übersicht ordnet Schutzmaßnahmen direkt den kritischen Stellen im Agentensystem zu.
Leitfäden
Suche gezielt oder steige direkt in die vollständige Sammlung ein.
21 Best Practices durchsuchen
Versuche einen allgemeineren Begriff wie Rechte, Monitoring oder Memory.
Alle Leitfäden
Konkrete Maßnahmen für Architektur, Entwicklung und Betrieb.
Best Practice
Aktualisiert 27.07.2026 · Model Robustness
Realistische Angriffsdaten, getrennte Evals und sichere Zielreaktionen härten Modelle gegen Prompt Injection, Jailbreaks und manipulierte Agentenkontexte.
Best Practice
Aktualisiert 27.07.2026 · Runtime Security
Isolierte Laufzeiten, minimale Freigaben und harte Ressourcenlimits begrenzen Codeausführung, Dateizugriffe und Netzwerkverkehr von KI-Agenten.
Best Practice
Aktualisiert 27.07.2026 · Operational Safety
Harte Limits für Tokens, Tool-Aufrufe, Laufzeit und Kosten stoppen Agentenschleifen, Denial of Wallet und unkontrollierten Ressourcenverbrauch.
Best Practice
Aktualisiert 27.07.2026 · Identity & Access
Kurzlebige Identitäten und laufende Risikoprüfungen binden Agentenzugriffe an Nutzer, Auftrag, Zielressource und aktuellen Ausführungskontext.
Best Practice
Aktualisiert 27.07.2026 · Data Governance
Datenminimierung, Zweckbindung und kontrollierte Speicher- und Ausgabepfade schützen personenbezogene und vertrauliche Daten in Agentenworkflows.
Best Practice
Aktualisiert 27.07.2026 · Runtime Governance
Laufende Soll-Ist-Prüfungen erkennen Abweichungen von Ziel, Scope und erlaubtem Handlungspfad und stoppen riskante Agentenaktionen frühzeitig.
Best Practice
Aktualisiert 27.07.2026 · Runtime Governance
Technische Freigabegates binden irreversible, externe und privilegierte Agentenaktionen an eine informierte menschliche Entscheidung.
Best Practice
Aktualisiert 27.07.2026 · Input Security
Externe Inhalte bleiben Daten: Quellen kennzeichnen, Kontext trennen und riskante Tool-Aktionen unabhängig vom Modell prüfen.
Best Practice
Aktualisiert 27.07.2026 · Incident Response
Ein autorisierter Not-Aus stoppt Sessions, Tools und Folgejobs zuverlässig und führt betroffene Agentenläufe in einen sicheren, auditierbaren Zustand.
Best Practice
Aktualisiert 27.07.2026 · Identity & Access
Rechte, Tools, Ziele und Parameter bleiben auf das fachlich nötige Minimum begrenzt und werden bei jedem Aufruf serverseitig autorisiert.
Best Practice
Aktualisiert 27.07.2026 · Context Integrity
Agentenkontext und persistente Memory bleiben herkunftsgebunden, mandantengetrennt, autorisiert und vor Vergiftung oder unkontrollierter Wiederverwendung geschützt.
Best Practice
Aktualisiert 27.07.2026 · Runtime Security
Kleine, identitätsbasierte Sicherheitssegmente begrenzen Verbindungen zwischen Agenten, Tools, MCP-Servern und Daten auf explizit erlaubte Pfade.
Best Practice
Aktualisiert 27.07.2026 · Observability
Korrelierte Logs, Metriken und Traces machen Entscheidungen, Tool-Aufrufe, Freigaben, Kosten und Sicherheitsereignisse über den gesamten Agentenlauf sichtbar.
Best Practice
Aktualisiert 27.07.2026 · Multi-Agent Coordination
Identitäten, Delegationen, Nachrichten, Tools und Zustände bleiben über Agentengrenzen hinweg authentisiert, begrenzt und nachvollziehbar.
Best Practice
Aktualisiert 27.07.2026 · Runtime Security
Modellausgaben werden vor Anzeige, Speicherung oder Ausführung gegen Schema, Policy, Daten- und Aktionsgrenzen geprüft.
Best Practice
Aktualisiert 27.07.2026 · Instruction Security
Rolle, Grenzen und Tool-Regeln so formulieren, dass fremde Inhalte den Auftrag eines KI-Agenten nicht unbemerkt verändern.
Best Practice
Aktualisiert 27.07.2026 · Input Security
Prompt-wirksame Eingaben vor dem Agentenlauf klassifizieren, begrenzen und bei erhöhtem Risiko isolieren oder freigeben.
Best Practice
Aktualisiert 27.07.2026 · Identity & Access
API-Keys, Tokens und Maschinenidentitäten kurzlebig, zweckgebunden und außerhalb des Modellkontexts verwalten.
Best Practice
Aktualisiert 27.07.2026 · Security Assurance
Agentenpfade, Tool-Aufrufe, Freigaben und Seiteneffekte vor Releases und nach Änderungen reproduzierbar prüfen.
Best Practice
Aktualisiert 27.07.2026 · Dependency Security
Externe Tools, MCP-Server, Modelle und Abhängigkeiten über Inventar, Provenance, minimale Scopes und Widerruf kontrollieren.
Best Practice
Aktualisiert 27.07.2026 · Security Design
Rollen, Datenflüsse, Tools, Speicher und Vertrauensgrenzen modellieren, um wirksame Angriffspfade früh zu erkennen.
Nächster Schritt
Die Threat Landscape zeigt, welche Angriffspfade hinter den Kontrollen stehen.