KI-BedrohungskatalogSchädliche InhalteProduktion
Unethisches Verhalten
Das KI-System empfiehlt oder erzeugt Handlungen, die zwar legal, aber ethisch fragwürdig sind, etwa Manipulation, Täuschung oder das Ausnutzen schutzbedürftiger Nutzender.
Beschreibung
Im Unterschied zu klar rechtswidrigen oder strafbaren Inhalten geht es hier um Vorgehensweisen im ethischen Graubereich: irreführende Argumentationen, verdeckte Beeinflussung oder sogenannte Dark Patterns, also Gestaltungsmuster, die Menschen zu Entscheidungen gegen ihr eigenes Interesse drängen. Gängige Inhaltsfilter erfassen dies kaum, weil das Verhalten nicht offen schädlich wirkt. Die KI-Verordnung zieht die Grenze bei absichtlich manipulativen oder täuschenden Techniken und beim Ausnutzen der Schutzbedürftigkeit einzelner Personengruppen.
Mögliche Auswirkung
Der Schaden liegt vor allem im Vertrauensverlust und in ethisch-reputativen Folgen für den Betreiber. Nähert sich das Systemverhalten gezielter Manipulation oder der Ausnutzung schutzbedürftiger Personen, kann es in den Bereich der nach der KI-Verordnung verbotenen Praktiken geraten.
Beispiel
Ein Verkaufsassistent rät dazu, unentschlossene Kundinnen und Kunden mit künstlicher Verknappung und irreführenden Countdown-Anzeigen zu einem übereilten Kauf zu drängen.
Empfohlene Gegenmaßnahmen (5)
Jede Maßnahme nennt ihre Maßnahmenart, Wirkung, Umsetzungsebene und die Begründung der Einordnung.
Ethik-Richtlinien im TrainingGovernance & Compliance
- Wirkung
- Präventiv
- Umsetzungsebene
- Modell & Training, Organisation
- Ergänzende Maßnahmenart
- Organisatorisch & prozessual
- Begründung der Einordnung
- „Ethik-Richtlinien im Training“ ist primär der Maßnahmenart Governance & Compliance zugeordnet: Verbindliche Regeln, Kontrollziele oder Aufsicht bestimmen Zulässigkeit und Rechenschaft; ergänzt durch verbindliche Abläufe.
Constitutional-AI-MethodenTechnisch
- Wirkung
- Präventiv
- Umsetzungsebene
- Modell & Training
- Begründung der Einordnung
- „Constitutional-AI-Methoden“ ist primär technisch: Ein Modell-, Trainings- oder Datenverfahren verändert Systemverhalten oder Robustheit unmittelbar.
Ethik-Review-GremienGovernance & Compliance
- Wirkung
- Präventiv
- Umsetzungsebene
- Organisation
- Ergänzende Maßnahmenart
- Organisatorisch & prozessual
- Begründung der Einordnung
- „Ethik-Review-Gremien“ ist primär der Maßnahmenart Governance & Compliance zugeordnet: Verbindliche Regeln, Kontrollziele oder Aufsicht bestimmen Zulässigkeit und Rechenschaft; ergänzt durch verbindliche Abläufe.
Transparenz über das ModellverhaltenGovernance & Compliance
- Wirkung
- Präventiv
- Umsetzungsebene
- Organisation, Nutzung & Betrieb
- Ergänzende Maßnahmenart
- Organisatorisch & prozessual
- Begründung der Einordnung
- „Transparenz über das Modellverhalten“ ist primär der Maßnahmenart Governance & Compliance zugeordnet: Verbindliche Regeln, Kontrollziele oder Aufsicht bestimmen Zulässigkeit und Rechenschaft; ergänzt durch verbindliche Abläufe.
Refusal-Muster für manipulative AnfragenTechnisch
- Wirkung
- Präventiv
- Umsetzungsebene
- Modell & Training, Anwendung, API & Agenten
- Begründung der Einordnung
- „Refusal-Muster für manipulative Anfragen“ ist primär technisch: Systemseitige Prüf-, Transformations- oder Blockierregeln stoppen oder neutralisieren unzulässige Inhalte vor der Weiterverarbeitung.
Standard-Zuordnungen
Verifizierte Fundstellen in OWASP, NIST AI RMF, MITRE ATLAS, EU AI Act und weiteren Rahmenwerken. Die Zuordnungen sind taxonomisch, kein Konformitätsnachweis.
Belegte Referenzen (5)
Jede Referenz nennt Rahmenwerk, Fundstelle und die herausgebende Organisation.
- NIST AI RMF Abschnitt 2.3 Dangerous, Violent, or Hateful ContentAbschnitt 2.3, pp. 6–7 National Institute of Standards and Technology (NIST)Original
- MITRE ATLAS AML.T0048.002 Societal HarmATLAS.yaml technique object with id AML.T0048.002 (pinned release v5.6.0) MITREOriginal
- EU AI Act Article 5(1)(a) Prohibited AI practicesArticle 5(1)(a); where the catalogue cites exploitation, compare Article 5(1)(b) European Union (EUR-Lex)Original
- EU AI Act Article 55(1)(b) Obligations of providers of general-purpose AI models with systemic riskArticle 55(1)(b) European Union (EUR-Lex)Original
- EU AI Act Article 9(1), 9(2)(a), 9(2)(d) Risk management systemArticle 9(1), 9(2)(a), 9(2)(d), read with Article 9(3) European Union (EUR-Lex)Original
Verwandte Bedrohungen
Weitere Einträge aus der Themengruppe Schädliche Inhalte.
Diese Bedrohung im eigenen System bewerten
Die Live-Demo enthält alle 52 Bedrohungen dieses Katalogs samt EU-AI-Act- und DSGVO-Einwertung. Die kostenlosen Einzelmodule decken KI-Risiko, EU-KI-VO und DSGVO ab. Ohne Registrierung; die Bewertung läuft lokal in Ihrem Browser.
Diesen Eintrag zitieren
Für Berichte, Richtlinien oder interne Unterlagen; der Link führt direkt auf diesen Eintrag.
„Unethisches Verhalten“. Versatile AI Risk Assessment, KI-Bedrohungskatalog, Stand Juli 2026. https://www.versatile-ai-risk-assessment.com/wissensbasis/bedrohungen/unethisches-verhalten/