A new audit finds popular AI-agent safety benchmarks can be beaten by simply guessing "unsafe" every time — meaning some scores measure gaming, not safety.
Continue to AI University →