Goodfire's interpretability tool Silico found human cognitive biases geometrically encoded inside Llama and Gemma.
Continue to AI University →