Versatile AI Risk Assessment

KI-BedrohungskatalogSchädliche InhalteProduktion

Hassrede und Diskriminierung

Das KI-System erzeugt Inhalte, die einzelne Personen oder Gruppen wegen geschützter Merkmale wie Herkunft, Geschlecht, Religion oder Behinderung herabsetzen oder zu deren Ausgrenzung aufrufen.

Stand: Juli 2026 · Katalogversion 2026.07.17.3 · 5 Gegenmaßnahmen · 9 belegte Quellen

Beschreibung

Solche Ausgaben entstehen auf drei Wegen: auf direkte Aufforderung, durch einen Jailbreak (das gezielte Umgehen der im Modell verankerten Schutzmechanismen) oder unbeabsichtigt, weil das Modell Vorurteile und Verzerrungen (Bias) aus seinen Trainingsdaten übernimmt. Die Bandbreite reicht von stereotypisierenden Formulierungen über abwertende Sprache bis zu Aufrufen zu Hass oder Gewalt gegen eine Identitätsgruppe. Betroffen sind alle Kanäle, in denen das System frei formulierte Texte ausgibt, etwa Chatbots, Assistenzsysteme oder automatisch erzeugte Entscheidungen.

Mögliche Auswirkung

Für den Betreiber entstehen Reputationsschäden, rechtliche Risiken nach dem Allgemeinen Gleichbehandlungsgesetz (AGG) und aufsichtsrechtliche Folgen. Diskriminierende Ausgaben verletzen das Grundrecht auf Nichtdiskriminierung und schädigen die betroffenen Personen unmittelbar. In automatisierten Verfahren, etwa bei Bewerbungen, können benachteiligende Ergebnisse ganze Personengruppen systematisch ausschließen.

Beispiel

Ein Bewerbungs-Chatbot formuliert eine Absage in einer Weise, die Bewerberinnen aufgrund ihres Geschlechts abwertet, oder ein Kundenservice-Assistent gibt auf eine harmlose Frage eine stereotypisierende Antwort über eine ethnische Gruppe aus.

Empfohlene Gegenmaßnahmen (5)

Jede Maßnahme nennt ihre Maßnahmenart, Wirkung, Umsetzungsebene und die Begründung der Einordnung.

Standard-Zuordnungen

Verifizierte Fundstellen in OWASP, NIST AI RMF, MITRE ATLAS, EU AI Act und weiteren Rahmenwerken. Die Zuordnungen sind taxonomisch, kein Konformitätsnachweis.

OWASP LLM Top 10 LLM01:2025NIST AI RMF Abschnitt 2.3 · Abschnitt 2.6 · MEASURE 2.11MITRE ATLAS AML.T0048.002EU AI Act Article 55(1)(b)BSI R5BIML BIML-LLM output:11 · BIML78 system:1

Belegte Referenzen (9)

Jede Referenz nennt Rahmenwerk, Fundstelle und die herausgebende Organisation.

Begriffe auf dieser Seite

Fachbegriffe aus dem Glossar, die in diesem Eintrag vorkommen. Jeder Verweis führt zur vollständigen Erklärung.

Weitere Einträge aus der Themengruppe Schädliche Inhalte.

Diese Bedrohung im eigenen System bewerten

Die Live-Demo enthält alle 52 Bedrohungen dieses Katalogs samt EU-AI-Act- und DSGVO-Einwertung. Die kostenlosen Einzelmodule decken KI-Risiko, EU-KI-VO und DSGVO ab. Ohne Registrierung; die Bewertung läuft lokal in Ihrem Browser.

Diesen Eintrag zitieren

Für Berichte, Richtlinien oder interne Unterlagen; der Link führt direkt auf diesen Eintrag.

„Hassrede und Diskriminierung“. Versatile AI Risk Assessment, KI-Bedrohungskatalog, Stand Juli 2026.
https://www.versatile-ai-risk-assessment.com/wissensbasis/bedrohungen/hassrede-und-diskriminierung/

← Zurück zum vollständigen Katalog