MIT AI Risk Repository · Additional evidence · 16.01.01.a

Social stereotypes and unfair discrimination.

Category: Risk area 1: Discrimination, Hate speech and Exclusion

Description

From Taxonomy of Risks posed by Language Models (Weidinger2022), as extracted by the MIT AI Risk Repository (CC BY 4.0).

Classification

Domain
Subdomain
Causal entity
Intent
Timing

Other entries from Weidinger2022