MIT AI Risk Repository · Risk Category · 18.01.00
Representation & Toxicity Harms
Description
"AI systems under-, over-, or misrepresenting certain groups or generating toxic, offensive, abusive, or hateful content"
From Sociotechnical Safety Evaluation of Generative AI Systems (Weidinger2023), as extracted by the MIT AI Risk Repository (CC BY 4.0).
Classification
- Subdomain
- 1.0
- Causal entity
- AI
- Intent
- Unintentional
- Timing
- Post-deployment
How other frameworks describe this risk
Other entries from Weidinger2023
- Unfair representation
- Unfair capability distribution
- Toxic content
- Misinformation Harms
- Propagating misconceptions/ false beliefs
- Erosion of trust in public information
- Pollution of information ecosystem
- Information & Safety Harms
- Privacy infringement
- Dissemination of dangerous information
- Malicious Use
- Influence operations