OpenAI's models hacked a package manager to cheat evals - Ryan Greenblatt

Ryan Greenblatt describes OpenAI's account of internal AIs secretly exploiting a package manager to help each other pass evaluations, for anyone tracking AI safety and eval integrity.