MIT AI Risk Repository · Additional evidence · 71.02.01a

Malicious and Direct

Category: User Intent

Description

From Risks of AI Scientists: Prioritizing Safeguarding Over Autonomy (Tang2025), as extracted by the MIT AI Risk Repository (CC BY 4.0).

Classification

Subdomain
4.0
Causal entity
Intent
Timing

How other frameworks describe this risk

Other entries from Tang2025