AIPolicyTracker

MIT AI Risk Repository · Additional evidence · 25.02.00.a

Deception

Description

—

From Model Evaluation for Extreme Risks (Shevlane2023), as extracted by the MIT AI Risk Repository (CC BY 4.0).

Classification

Domain
—
Subdomain
—
Causal entity
—
Intent
—
Timing
—

Other entries from Shevlane2023