Versatile AI Risk Assessment

KI-BedrohungskatalogPrompt-Angriffe und Umgehung von SchutzmechanismenProduktion

Prompt Injection – Indirekt

Bösartige Anweisungen stecken versteckt in externen Inhalten wie Dokumenten, Webseiten oder E-Mails. Verarbeitet das KI-System diesen Inhalt im normalen Betrieb, führt es die versteckten Befehle unbemerkt mit aus.

Stand: Juli 2026 · Katalogversion 2026.07.17.3 · 5 Gegenmaßnahmen · 12 belegte Quellen

Beschreibung

Bei der indirekten Prompt Injection stammt die Manipulation nicht von der nutzenden Person, sondern von Dritten, die präparierte Inhalte platzieren. Angreifer tarnen die Anweisungen, etwa als weiße Schrift auf weißem Grund, in Schriftgröße Null oder in einem Video-Transkript. Ruft das Modell solche Quellen ab, zum Beispiel beim Zusammenfassen einer Webseite oder in einem RAG-System (Retrieval Augmented Generation), das zur Beantwortung von Fragen externe Dokumente heranzieht, behandelt es den versteckten Text als Anweisung. Betroffen ist meist die Person, die dem System vertraut, nicht der Angreifer selbst.

Mögliche Auswirkung

Das System kann Zusammenfassungen verfälschen, Nutzende auf schädliche Links lenken oder vertrauliche Daten an eine fremde Adresse ausleiten, etwa durch das Nachladen externer Bilder. In verbundenen Systemen können versteckte Befehle E-Mails aus dem Postfach des Opfers versenden oder weitere Aktionen anstoßen. Das schädigt Datenschutz, Betrieb und Vertrauen.

Beispiel

Eine Mitarbeiterin lässt sich vom KI-System eine eingegangene E-Mail zusammenfassen. In der Nachricht steht unsichtbarer Text, der das System anweist, den bisherigen Chatverlauf an eine externe Adresse zu schicken. Das System befolgt die versteckte Anweisung, ohne dass es jemand merkt.

Empfohlene Gegenmaßnahmen (5)

Jede Maßnahme nennt ihre Maßnahmenart, Wirkung, Umsetzungsebene und die Begründung der Einordnung.

Standard-Zuordnungen

Verifizierte Fundstellen in OWASP, NIST AI RMF, MITRE ATLAS, EU AI Act und weiteren Rahmenwerken. Die Zuordnungen sind taxonomisch, kein Konformitätsnachweis.

OWASP LLM Top 10 LLM01:2025NIST AI RMF Abschnitt 2.9 · NISTAML.015MITRE ATLAS AML.T0051.001EU AI Act Article 14(4)(d) · Article 55(1)(a)BSI R28 · R3 · R7BIML BIML-LLM input:2 · BIML-LLM LLMtop10:5 · BIML-LLM raw:10

Belegte Referenzen (12)

Jede Referenz nennt Rahmenwerk, Fundstelle und die herausgebende Organisation.

Begriffe auf dieser Seite

Fachbegriffe aus dem Glossar, die in diesem Eintrag vorkommen. Jeder Verweis führt zur vollständigen Erklärung.

Weitere Einträge aus der Themengruppe Prompt-Angriffe und Umgehung von Schutzmechanismen.

Diese Bedrohung im eigenen System bewerten

Die Live-Demo enthält alle 52 Bedrohungen dieses Katalogs samt EU-AI-Act- und DSGVO-Einwertung. Die kostenlosen Einzelmodule decken KI-Risiko, EU-KI-VO und DSGVO ab. Ohne Registrierung; die Bewertung läuft lokal in Ihrem Browser.

Diesen Eintrag zitieren

Für Berichte, Richtlinien oder interne Unterlagen; der Link führt direkt auf diesen Eintrag.

„Prompt Injection – Indirekt“. Versatile AI Risk Assessment, KI-Bedrohungskatalog, Stand Juli 2026.
https://www.versatile-ai-risk-assessment.com/wissensbasis/bedrohungen/prompt-injection-indirekt/

← Zurück zum vollständigen Katalog