Alle Analysen
Agent Goal Hijacking
Fremde Inhalte oder fehlerhafte Zustände können Ziele, Prioritäten und Entscheidungen eines KI-Agenten verschieben, während seine Aktionen weiterhin plausibel wirken.
Bedrohungen
Die wichtigsten Angriffs- und Fehlermodi für KI-Agenten – kompakt eingeordnet und direkt vertiefbar.
Landscape
Die Übersicht zeigt Bedrohungen entlang von Input, Orchestrierung, Tools und Datenflüssen.
Analysen
Suche gezielt oder steige direkt in die vollständige Sammlung ein.
11 Threats durchsuchen
Versuche einen allgemeineren Begriff wie Memory, Identity oder Tools.
Konkrete Angriffspfade, Auswirkungen und passende Gegenmaßnahmen.
Alle Analysen
Fremde Inhalte oder fehlerhafte Zustände können Ziele, Prioritäten und Entscheidungen eines KI-Agenten verschieben, während seine Aktionen weiterhin plausibel wirken.
Alle Analysen
Kompromittierte Plugins, Connectoren, MCP-Server oder Tool-Schemas können den vertrauenswürdigen Ausführungspfad eines KI-Agenten manipulieren.
Alle Analysen
Lokale Fehler oder manipulierte Zustände können sich über Handoffs, Memory, Tools und Folgeagenten ausbreiten und zu systemischem Schaden eskalieren.
Alle Analysen
Überzeugende Sprache, Personalisierung oder schwache Freigabeoberflächen können Menschen dazu bringen, riskanten Empfehlungen eines KI-Agenten zu stark zu vertrauen.
Alle Analysen
KI-Agenten können mit zu breiten oder falsch gebundenen Rechten handeln. Gefährlich wird das, wenn legitime Identitäten unautorisierte Zugriffe verschleiern.
Alle Analysen
Nachrichten zwischen KI-Agenten können gefälscht oder falsch autorisiert sein. Gefährlich wird das, wenn daraus Delegationen, Tool-Aufrufe oder Datenzugriffe entstehen.
Alle Analysen
Fremde Inhalte können in Kontext und Memory eines KI-Agenten bestehen bleiben. Gefährlich wird das, wenn spätere Entscheidungen und Tool-Aufrufe diesem Zustand vertrauen.
Alle Analysen
Fremde Inhalte können für einen KI-Agenten zur Anweisung werden. Gefährlich wird das, wenn daraus Datenzugriffe, Tool-Aufrufe oder andere Aktionen entstehen.
Alle Analysen
Rogue Agents handeln außerhalb ihres autorisierten Ziels, ihrer Rolle oder ihrer Rechte – durch Kompromittierung, Fehlsteuerung oder Kontrollverlust.
Alle Analysen
Legitime Tools werden für unsichere, unautorisierte oder fachlich falsche Aktionen genutzt – mit realen Folgen für Daten, Systeme und Geschäftsprozesse.
Alle Analysen
Ein KI-Agent löst unerwartet Shell-, Skript- oder andere Codeausführung aus und überträgt damit unsichere Modellentscheidungen in eine reale Laufzeit.
Nächster Schritt
Die Best Practices zeigen, wie sich diese Angriffspfade wirksam begrenzen lassen.