Versatile AI Risk Assessment

KI-BedrohungskatalogAutonome KI und AgentenProduktion

Agenten-KI / Autonome Agenten

KI-Agenten planen mehrstufige Aufgaben selbstständig und führen sie mit Werkzeugen wie E-Mail, Datenbanken oder Codeausführung aus. Je weniger Menschen dabei mitwirken, desto weiter reichen Planungsfehler, manipulierte Inhalte und Folgefehler.

Stand: Juli 2026 · Katalogversion 2026.07.17.3 · 7 Gegenmaßnahmen · 13 belegte Quellen

Beschreibung

Ein KI-Agent zerlegt einen Auftrag in Einzelschritte, ruft dafür selbstständig Werkzeuge und Schnittstellen auf und verarbeitet die Ergebnisse im nächsten Schritt weiter. In dieser Kette kumulieren mehrere Risiken: Planungs- und Bewertungsfehler setzen sich über die Schritte fort, und Angreifer können den Agenten über Inhalte umlenken, die er bei der Arbeit liest, etwa per Prompt Injection (versteckte Anweisungen in E-Mails, Dokumenten oder Webseiten). Ein umgelenkter oder fehlgeleiteter Agent nutzt dann seine legitimen Werkzeuge für schädliche Aktionen, führt Code aus oder leitet Daten nach außen. In Systemen aus mehreren Agenten kann sich ein einzelner Fehler kaskadenartig über weitere Agenten und Arbeitsabläufe ausbreiten.

Mögliche Auswirkung

Betroffen ist alles, was der Agent erreichen kann: Es drohen ungewollte Transaktionen, Datenabfluss, gelöschte Dateien und Ausfälle ganzer Abläufe. Kaskadeneffekte können den Schaden über das einzelne System hinaus ausweiten. Der EU AI Act verlangt für Hochrisiko-Systeme, dass Menschen wirksam beaufsichtigen, eingreifen und das System anhalten können; bei großen KI-Modellen mit allgemeinem Verwendungszweck nennt die Verordnung Autonomiegrad und Werkzeugzugriff als Faktoren systemischer Risiken.

Beispiel

Ein Entwicklungs-Agent mit Zugriff auf die Kommandozeile arbeitet Aufgaben aus Projektdateien ab. Eine präparierte Datei enthält versteckte Anweisungen, die der Agent als Auftrag versteht: Er führt einen Löschbefehl aus und vernichtet Daten auf dem System. Dabei bewegt er sich vollständig innerhalb seiner regulären Werkzeugrechte.

Empfohlene Gegenmaßnahmen (7)

Jede Maßnahme nennt ihre Maßnahmenart, Wirkung, Umsetzungsebene und die Begründung der Einordnung.

Standard-Zuordnungen

Verifizierte Fundstellen in OWASP, NIST AI RMF, MITRE ATLAS, EU AI Act und weiteren Rahmenwerken. Die Zuordnungen sind taxonomisch, kein Konformitätsnachweis.

OWASP LLM Top 10 ASI01:2026 · ASI02:2026 · ASI08:2026 · LLM01:2025 · LLM06:2025NIST AI RMF Abschnitt 3.5MITRE ATLAS AML.T0051EU AI Act Article 14(4)(d) · Article 26(5) · Article 55(1)(a) · Article 9(1), 9(2)(a), 9(2)(d)BSI R28BIML BIML78 system:5

Belegte Referenzen (13)

Jede Referenz nennt Rahmenwerk, Fundstelle und die herausgebende Organisation.

Begriffe auf dieser Seite

Fachbegriffe aus dem Glossar, die in diesem Eintrag vorkommen. Jeder Verweis führt zur vollständigen Erklärung.

Weitere Einträge aus der Themengruppe Autonome KI und Agenten.

Diese Bedrohung im eigenen System bewerten

Die Live-Demo enthält alle 52 Bedrohungen dieses Katalogs samt EU-AI-Act- und DSGVO-Einwertung. Die kostenlosen Einzelmodule decken KI-Risiko, EU-KI-VO und DSGVO ab. Ohne Registrierung; die Bewertung läuft lokal in Ihrem Browser.

Diesen Eintrag zitieren

Für Berichte, Richtlinien oder interne Unterlagen; der Link führt direkt auf diesen Eintrag.

„Agenten-KI / Autonome Agenten“. Versatile AI Risk Assessment, KI-Bedrohungskatalog, Stand Juli 2026.
https://www.versatile-ai-risk-assessment.com/wissensbasis/bedrohungen/autonome-agenten/

← Zurück zum vollständigen Katalog