Glossar Bedrohungen und Schwächen
Prompt Injection
Manipulierte Eingaben oder eingeschleuste Inhalte steuern ein Sprachmodell um.
Bedeutung und Einordnung
Prompt Injection bezeichnet Angriffe, bei denen manipulierte Eingaben oder eingeschleuste Inhalte (etwa in Dokumenten, Webseiten oder E-Mails) das Verhalten eines Sprachmodells umsteuern. Das Modell folgt dann Anweisungen des Angreifers statt den Vorgaben des Betreibers, zum Beispiel zum Ausleiten vertraulicher Daten oder zum Umgehen von Schutzregeln.
Wirksame Kontrollen kombinieren Eingabe- und Ausgabefilter, die strikte Trennung von Anweisungen und Daten, minimale Berechtigungen für angebundene Werkzeuge sowie Tests mit bekannten Angriffsmustern. Die Restrisiken bleiben dokumentationspflichtig, weil kein Filter vollständig schützt.
Bedrohungen mit diesem Begriff (10)
Die ersten 8 von 10 Einträgen des Bedrohungskatalogs, in deren Text der Begriff vorkommt. Jeder Verweis führt zur vollständigen Bedrohungsseite.
Verwandte Begriffe
Weitere Begriffe aus dem Themenfeld Bedrohungen und Schwächen.
Passende Inhalte in der Wissensbasis
Vertiefen Sie das Thema über den folgenden Verweis. In der Glossarübersicht finden Sie weitere Begriffe, geordnet nach Themenfeld.
Diesen Begriff zitieren
Für Berichte, Richtlinien oder interne Unterlagen; der Link führt direkt auf diese Begriffsseite.
„Prompt Injection“. Versatile AI Risk Assessment, Glossar der KI-Risikoanalyse, Stand September 2026. https://www.versatile-ai-risk-assessment.com/wissensbasis/glossar/prompt-injection/