Researchers found assigning an LLM a persona in its system prompt can flip its safety decisions on the exact same request.
Continue to AI University →