Versatile AI Risk Assessment

Zwei Bedrohungen und ihre gemeinsamen Fundstellen

Wählen Sie zwei Bedrohungen oder ein vorgeschlagenes Paar mit großer Überschneidung. Die mittlere Spalte zeigt die Stellen, auf die beide verweisen; die äußeren zeigen, was jeweils nur für eine gilt. Darunter stehen die Gegenmaßnahmen beider Seiten.

Für wen: Für alle, die Richtlinien, Schulungen oder Prüfpläne formulieren

Bedrohungsvergleich

Backdoor im ML-Modell und Sleepy Agent (zeit-/ereignisgetriggerte verdeckte Instruktionen) teilen 11 von 16 Fundstellen. Beide stehen in derselben Themengruppe.

11gemeinsame Fundstellen
4nur bei der ersten
1nur bei der zweiten
4 zu 6Gegenmaßnahmen im Katalog
2/5gemeinsame Wirkungsarten

Nur Backdoor im ML-Modell4

Manipulation von Modell und Trainingsdaten · Entwicklung

BIML BIML78 model:2BSI R20NIST AI RMF NISTAML.021NIST AI RMF NISTAML.026

Beiden gemeinsam11

dieselbe Stelle im selben Regelwerk

BIML BIML-LLM model:4BSI R19EU AI Act Article 53(1)(a)EU AI Act Article 55(1)(a)EU AI Act Article 9(1), 9(2)(a), 9(2)(d)MITRE ATLAS AML.T0018NIST AI RMF Abschnitt 2.9NIST AI RMF MEASURE 2.7NIST AI RMF NISTAML.023NIST AI RMF NISTAML.051OWASP LLM Top 10 LLM04:2025

Nur Sleepy Agent (zeit-/ereignisgetriggerte verdeckte Instruktionen)1

Manipulation von Modell und Trainingsdaten · Entwicklung

MITRE ATLAS AML.T0020

Backdoor im ML-Modell 4 Gegenmaßnahmen

In das Modell ist ein verstecktes Verhalten eingebaut, eine Backdoor (Hintertür). Bei normalen Eingaben arbeitet es korrekt; erst ein geheimes Auslösemuster in der Eingabe kippt die Ausgabe in das vom Angreifer gewünschte Ergebnis.

  • Modell-Scanning auf Backdoors

    Wirkung: AufdeckendUmsetzungsebene: Modell & TrainingMaßnahmenart: Technisch

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren.

  • Neural-Cleanse-Techniken

    Wirkung: AufdeckendUmsetzungsebene: Modell & TrainingMaßnahmenart: Technisch

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren.

  • Analyse von Aktivierungs-Clustern

    Wirkung: AufdeckendUmsetzungsebene: Modell & TrainingMaßnahmenart: Technisch

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren.

  • Nur von vertrauenswürdigen Basismodellen trainieren

    Wirkung: PräventivUmsetzungsebene: Modell & Training, LieferketteMaßnahmenart: Organisatorisch & prozessualErgänzende Art: Technisch

    Begründung der Einordnung

    Primär organisatorisch & prozessual: Festgelegte Auswahl-, Betriebs- oder Lebenszyklusabläufe machen die Maßnahme verbindlich und wiederholbar; ergänzt durch technische Umsetzung.

Sleepy Agent (zeit-/ereignisgetriggerte verdeckte Instruktionen) 6 Gegenmaßnahmen

Im Modell schlummert verdeckte Schadlogik, die sich erst zeitversetzt aktiviert: an einem Stichtag, bei einem bestimmten Ereignis oder in einer bestimmten Umgebung. Bis dahin besteht das System alle Tests und Prüfungen unauffällig.

  • Verhaltensanalyse unter diversen Bedingungen

    Wirkung: AufdeckendUmsetzungsebene: Modell & TrainingMaßnahmenart: Technisch

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren.

  • Tests mit verschobener Zeitbasis

    Wirkung: AufdeckendUmsetzungsebene: Modell & TrainingMaßnahmenart: Technisch

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren.

  • Adversariale Evaluierung über verschiedene Kontexte hinweg

    Wirkung: AufdeckendUmsetzungsebene: Modell & TrainingMaßnahmenart: Technisch

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren.

  • Laufzeit-Verhaltensüberwachung

    Wirkung: AufdeckendUmsetzungsebene: Modell & Training, Nutzung & BetriebMaßnahmenart: TechnischErgänzende Art: Organisatorisch & prozessual

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren; ergänzt durch verbindliche Abläufe.

  • Werkzeuge zur Modell-Interpretierbarkeit

    Wirkung: AufdeckendUmsetzungsebene: Modell & TrainingMaßnahmenart: Technisch

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren.

  • Integritätsprüfung der Lieferkette

    Wirkung: Präventiv, AufdeckendUmsetzungsebene: Modell & Training, LieferketteMaßnahmenart: TechnischErgänzende Art: Organisatorisch & prozessual

    Begründung der Einordnung

    Primär technisch: Software oder Analysewerkzeuge erzeugen und bewerten systematisch Messwerte, Abweichungen oder Angriffsindikatoren; ergänzt durch verbindliche Abläufe.

AngriffsverlaufWie eine dieser Bedrohungen im Einzelnen verläuft, zeigt der Angriffsverlauf.

Die Datei zeigt den aktuellen Stand samt gesetzter Filter und enthält Hinweis, Katalogstand und Quelle.

Eine gemeinsame Fundstelle bedeutet, dass beide Bedrohungen auf dieselbe Stelle desselben Regelwerks verweisen. Sie sagt nicht, dass eine Gegenmaßnahme beide abdeckt.

Versatile AI Risk Assessment ist ein Hilfsmittel zur Strukturierung und Transparenz von KI‑Risiken. Es ersetzt keine Rechts- oder Fachberatung und trifft keine verbindlichen Entscheidungen.

Bedrohungen verstehen

Dieselben Daten, andere Frage

Was eine Bedrohung ausmacht, wann sie entsteht und wie sie sich von einer anderen unterscheidet.

  1. Vorschau der Auswertung: Angriffsverlauf Angriffsverlauf Wie entsteht der Schaden? Für alle, die eine Bedrohung zum ersten Mal fachlich durchdringen
  2. Vorschau der Auswertung: Lebenszyklus Lebenszyklus Wann entsteht welches Risiko? Für Governance, Beschaffung und Programmleitung
Das eigene System einordnen
Gegenmaßnahmen planen
Regelwerke und Belege prüfen

Übersicht aller zehn Auswertungen

Weiterführend
Bedrohungskatalog

Alle 52 Bedrohungen im Volltext: Beschreibung, Auswirkung, Beispiel, Gegenmaßnahmen und belegte Quellen.

Zum Katalog
EU‑AI‑Act‑Schnellprüfer

Vier kurze Abschnitte entlang der EU‑KI‑Verordnung für eine erste, unverbindliche Einordnung Ihres Systems.

Zum Schnellprüfer
Selbst bewerten

Die vollständige Bewertung mit Systemkontext, Bedrohungsauswahl und Nachweisführung, kostenlos im Browser.

Zur Live‑Demo