Technical Safeguards Against Extreme Misuse of AI: Current Landscape and Future Directions
Across all model types and deployment settings, pre-deployment evaluations for dangerous capabilities and safeguard robustness are essential inputs for responsible release decisions. Neither proprietary nor open-weight models are inherently dangerous; risk depends on their capabilities.