MIT AI Risk Repository · Additional evidence · 71.02.02a

Malicious and Indirect

Category: User Intent

Description

From Risks of AI Scientists: Prioritizing Safeguarding Over Autonomy (Tang2025), as extracted by the MIT AI Risk Repository (CC BY 4.0).

Classification

Subdomain
4.0
Causal entity
Intent
Timing

How other frameworks describe this risk

Other entries from Tang2025